{"meta":{"query_hash":"0eee3839674e","filters":{"topic":"Computational and Text Analysis Methods"},"cohort_total":514,"direct_labels_cover":5,"predictions_cover":514,"exported":514,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/0eee3839674e","api":"https://metacan.xera.ac/api/v1/cohort?topic=Computational+and+Text+Analysis+Methods"},"results":[{"id":"W1520902659","doi":"10.22230/src.2013v4n3a121","title":"Reading Thomas Jefferson with TopicViz: Towards a Thematic Method for Exploring Large Cultural Archives","year":2013,"lang":"en","type":"article","venue":"Scholarly and Research Communication","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Digitization; Workflow; Reading (process); Data science; World Wide Web; Cultural heritage; Visualization; EPIC; Thematic map; Software; Database; History; Artificial intelligence; Linguistics; Programming language; Literature","score_opus":0.2743791472729266,"score_gpt":0.49913888445585575,"score_spread":0.22475973718292913,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1520902659","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011241317,0.00031247357,0.97636276,0.0010246787,0.00006413214,0.00031529757,0.00073337794,0.0031733755,0.006772654],"genre_scores_gemma":[0.045346178,0.00026262616,0.9487268,0.00011173402,0.000054883265,0.0007359565,0.0007115212,0.00091155566,0.0031388027],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99531186,0.003047497,0.00023573398,0.0006779068,0.0006388105,0.000088168876],"domain_scores_gemma":[0.98314255,0.012592392,0.0008542357,0.0022121444,0.00074751995,0.00045114142],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.008951612,0.00083349907,0.0008307026,0.007629094,0.0028673508,0.009847806,0.0019865714,0.0012776484,0.011349616],"category_scores_gemma":[0.025534008,0.0007617997,0.0014942006,0.007866209,0.0030432104,0.007745782,0.0053580385,0.0016848752,0.0025483598],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024153158,0.00021142214,0.007879645,0.001539258,0.00022218956,0.0010051285,0.11462366,0.0055220607,0.008794571,0.3432439,0.030845296,0.48587143],"study_design_scores_gemma":[0.00013885628,0.00008780101,0.0048698927,0.00076578633,0.00013014716,0.0013233046,0.03378505,0.06734661,0.009699092,0.47691908,0.4047881,0.00014625],"about_ca_topic_score_codex":0.0023759978,"about_ca_topic_score_gemma":0.0051970473,"teacher_disagreement_score":0.9910484,"about_ca_system_score_codex":0.0013129602,"about_ca_system_score_gemma":0.0025576998,"threshold_uncertainty_score":0.047341228},"labels":[],"label_agreement":null},{"id":"W1597876521","doi":"10.1002/9781119959847.ch1","title":"“It Looks Great but How do I know if it Fits?”: An Introduction to Meta‐Synthesis Research","year":2011,"lang":"en","type":"other","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":76,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Thompson Rivers University","funders":"","keywords":"Selection (genetic algorithm); Computer science; Qualitative research; Management science; Epistemology; Data science; Engineering ethics; Sociology; Engineering; Artificial intelligence; Social science; Philosophy","score_opus":0.21459715583984346,"score_gpt":0.4432425419013202,"score_spread":0.22864538606147672,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1597876521","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018246884,0.27300012,0.51406515,0.084724054,0.011955015,0.0063720024,0.0037270423,0.0011937232,0.10313812],"genre_scores_gemma":[0.019728662,0.19529612,0.7152892,0.016988019,0.0027187397,0.017636994,0.0016352189,0.0009760683,0.029731037],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95218164,0.04117999,0.0021422869,0.0011962513,0.0030753494,0.00022458029],"domain_scores_gemma":[0.91486096,0.0762258,0.0016980461,0.0025424568,0.004223467,0.0004493148],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0531918,0.0014245857,0.0018518295,0.006083897,0.0020366586,0.0071466854,0.0024641098,0.0029688722,0.019647898],"category_scores_gemma":[0.07245659,0.0012903915,0.001997586,0.011025794,0.0047121365,0.008892049,0.0037857217,0.006116908,0.00579706],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000777366,0.000057668265,0.00028774224,0.018915966,0.0002888103,0.00012867154,0.013632656,0.0014379567,0.00065533904,0.51620895,0.16863926,0.27966923],"study_design_scores_gemma":[0.000029974122,0.000052221385,0.00043390744,0.01555213,0.00008085014,0.00017661668,0.0027495313,0.0010443785,0.0006227559,0.19278255,0.78640634,0.00006888617],"about_ca_topic_score_codex":0.0021378156,"about_ca_topic_score_gemma":0.004472563,"teacher_disagreement_score":0.9468082,"about_ca_system_score_codex":0.004731487,"about_ca_system_score_gemma":0.008537688,"threshold_uncertainty_score":0.28130847},"labels":[],"label_agreement":null},{"id":"W1964078980","doi":"10.2139/ssrn.1026961","title":"Automatic Annotation of Semantic Fields for Political Science Research","year":2007,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"","keywords":"Annotation; Politics; Computer science; Information retrieval; Natural language processing; Data science; Artificial intelligence; Political science; Law","score_opus":0.0662732868529866,"score_gpt":0.4898803160267777,"score_spread":0.42360702917379106,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1964078980","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16974019,0.005819937,0.6343032,0.00953805,0.0022206595,0.0017257469,0.08481076,0.013173951,0.07866755],"genre_scores_gemma":[0.33854896,0.0020017014,0.584599,0.00044254653,0.00053863943,0.0009824707,0.064941436,0.0012026352,0.0067425417],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965823,0.0014217814,0.0004920516,0.00058527215,0.00072720984,0.00019139933],"domain_scores_gemma":[0.9736527,0.015353148,0.002321472,0.003126041,0.0048027365,0.0007440057],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005237271,0.0007258118,0.0006040729,0.023345208,0.0032730042,0.0038421915,0.0010323283,0.0015275991,0.009125223],"category_scores_gemma":[0.022316836,0.00049462396,0.0009434525,0.015808158,0.0013215572,0.006381454,0.0028337599,0.002018203,0.0035227723],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006910195,0.00047316536,0.020376526,0.0034055968,0.00010037298,0.0006942811,0.0056550554,0.0035170228,0.03522312,0.28264907,0.122465536,0.52474934],"study_design_scores_gemma":[0.00012852003,0.000105620646,0.02518455,0.001335865,0.00030680298,0.0009214998,0.004806904,0.0633468,0.02909508,0.42284927,0.45177257,0.00014647469],"about_ca_topic_score_codex":0.0034750851,"about_ca_topic_score_gemma":0.0067165256,"teacher_disagreement_score":0.023345208,"about_ca_system_score_codex":0.0022268572,"about_ca_system_score_gemma":0.004766173,"threshold_uncertainty_score":0.030526936},"labels":[],"label_agreement":null},{"id":"W2028141008","doi":"10.1111/j.1740-9713.2012.00583.x","title":"Big Data and City Living – What can it do for Us?","year":2012,"lang":"en","type":"article","venue":"Significance","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":52,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Big data; Data science; Computer science; Gerontology; Medicine; Data mining","score_opus":0.1951561860669645,"score_gpt":0.4091075099082735,"score_spread":0.213951323841309,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2028141008","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00097060384,0.034377463,0.0012745918,0.9524701,0.0049365074,0.000012353715,0.00025025554,0.00007326006,0.0056349323],"genre_scores_gemma":[0.16808839,0.29394346,0.014278822,0.4613808,0.034896497,0.00030970143,0.0016058413,0.0007374379,0.02475909],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99307644,0.0041258526,0.00021796388,0.00048949267,0.0015831342,0.0005071593],"domain_scores_gemma":[0.95934975,0.02164808,0.0016034765,0.0024346912,0.009376304,0.0055876137],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017857585,0.0012610826,0.0015198961,0.0037795801,0.005698165,0.01850397,0.0019926406,0.005512214,0.014409269],"category_scores_gemma":[0.053001754,0.0004961116,0.0009846222,0.00660659,0.012274258,0.033988964,0.00609786,0.010274366,0.0055587324],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013855015,0.000077961595,0.006786262,0.0010712224,0.00014515029,0.00009201043,0.002137464,0.000525242,0.00011001626,0.08505011,0.7742192,0.12964676],"study_design_scores_gemma":[0.000034253506,0.00005618418,0.0037161305,0.0036230774,0.000065100554,0.00009401671,0.0147327,0.0008827598,0.00028766738,0.41385174,0.5625432,0.000113164875],"about_ca_topic_score_codex":0.014106019,"about_ca_topic_score_gemma":0.01818165,"teacher_disagreement_score":0.01850397,"about_ca_system_score_codex":0.004796874,"about_ca_system_score_gemma":0.009342521,"threshold_uncertainty_score":0.094441056},"labels":[],"label_agreement":null},{"id":"W2029410674","doi":"10.7152/acro.v23i1.14262","title":"A Review of Boundary Objects in Classification Research","year":2013,"lang":"en","type":"review","venue":"Advances in Classification Research Online","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Situated; Classification scheme; Computer science; Boundary (topology); Biological classification; Empirical research; Data science; Boundary line; Scale (ratio); Open research; Knowledge management; Management science; Epistemology; Artificial intelligence; World Wide Web; Mathematics; Geography; Cartography","score_opus":0.5728065970977333,"score_gpt":0.6644926672832837,"score_spread":0.09168607018555042,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2029410674","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00016831637,0.9911622,0.0021984284,0.0017854685,0.00055872276,0.000017244127,0.000037984017,0.000017863567,0.0040538176],"genre_scores_gemma":[0.002694991,0.99179935,0.0028718577,0.0007654096,0.00077787274,0.000049280614,0.000099114295,0.000012933174,0.00092915667],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9961248,0.0014689589,0.0005814113,0.00046757978,0.0012003909,0.00015684965],"domain_scores_gemma":[0.9833709,0.012828882,0.0007883823,0.00044607025,0.0023340022,0.00023178553],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00543926,0.0011246529,0.0023129298,0.014901575,0.0015653141,0.0045868545,0.0017667103,0.0025981227,0.0072668283],"category_scores_gemma":[0.015656747,0.0006998325,0.0011323834,0.02642357,0.0037109694,0.008671083,0.0018371064,0.0029724396,0.0038816195],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000036411147,0.00007155214,0.0007836346,0.027116057,0.00012226492,0.00014032495,0.0010454642,0.0006093438,0.00028988457,0.075257935,0.0923246,0.80220246],"study_design_scores_gemma":[0.0000073935985,0.0000317375,0.0015851395,0.024088733,0.00007835214,0.00043563577,0.00051742827,0.0002704945,0.000140173,0.031707197,0.94110227,0.000035539368],"about_ca_topic_score_codex":0.005493303,"about_ca_topic_score_gemma":0.0072046053,"teacher_disagreement_score":0.014901575,"about_ca_system_score_codex":0.0039768093,"about_ca_system_score_gemma":0.0061682346,"threshold_uncertainty_score":0.028853893},"labels":[],"label_agreement":null},{"id":"W2035979290","doi":"10.1167/14.10.816","title":"Testing the face-specificity of the inversion effect in budgie experts","year":2014,"lang":"en","type":"article","venue":"Journal of Vision","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Perception; Cognitive psychology; Inversion (geology); Face perception; Psychology; Artificial intelligence; Cognitive neuroscience of visual object recognition; Computer science; Object (grammar); Communication; Biology","score_opus":0.051642088009848125,"score_gpt":0.3739011689947988,"score_spread":0.3222590809849507,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035979290","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9995876,0.000007198855,0.00009831287,0.000007896532,0.000001337236,0.000004306433,0.000014398911,0.0000018285921,0.0002771388],"genre_scores_gemma":[0.9987669,0.000013294454,0.0005165582,0.000024150615,0.0000026778187,0.000012263249,0.000062638646,0.000005024148,0.0005964705],"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","domain_scores_codex":[0.9996209,0.000053364478,0.00003227146,0.00012613501,0.00007782449,0.00008943928],"domain_scores_gemma":[0.9964127,0.0019104127,0.00046041535,0.00035443815,0.00024549046,0.00061658403],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006946622,0.00033007123,0.00033973795,0.00051388814,0.0002348889,0.00042845035,0.00031995217,0.00054836035,0.00474041],"category_scores_gemma":[0.003450302,0.00020333311,0.00017101572,0.000112062036,0.0008452168,0.0005258018,0.00082104746,0.0007153558,0.00034329295],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002800729,0.0019738222,0.18652515,0.00013359351,0.00010931384,0.0007041264,0.0017937208,0.00040382778,0.78459007,0.0004945405,0.00031404555,0.020157006],"study_design_scores_gemma":[0.000051167794,0.002500331,0.94818103,0.00000860127,0.000036324287,0.0009011584,0.0005903238,0.0015839754,0.045205425,0.00039105583,0.0005268603,0.00002367192],"about_ca_topic_score_codex":0.0017742122,"about_ca_topic_score_gemma":0.0029767714,"teacher_disagreement_score":0.00474041,"about_ca_system_score_codex":0.00023415993,"about_ca_system_score_gemma":0.00012319542,"threshold_uncertainty_score":0.015858293},"labels":[],"label_agreement":null},{"id":"W2041314074","doi":"10.1017/s0007123411000160","title":"Language and Ideology in Congress","year":2011,"lang":"en","type":"article","venue":"British Journal of Political Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":168,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Kellogg's (Canada)","funders":"","keywords":"Ideology; Legislature; Interpretation (philosophy); Political science; Politics; Law; Linguistics; Philosophy","score_opus":0.03988064428790917,"score_gpt":0.38087672527563565,"score_spread":0.3409960809877265,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2041314074","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.978255,0.0016741036,0.00023007512,0.00088623865,0.000057287598,0.000008511232,0.0005658733,0.000009103448,0.018313937],"genre_scores_gemma":[0.9971994,0.00051024294,0.0001847361,0.00006578738,0.000058341557,0.000015936923,0.00040079083,0.000011733904,0.0015530258],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99750155,0.001248173,0.00019621794,0.00024693905,0.0005660599,0.00024114488],"domain_scores_gemma":[0.98932344,0.0066389847,0.0026953819,0.00023896173,0.0007750483,0.000328093],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017241472,0.00013760201,0.00027237242,0.004197621,0.0010670974,0.0030953882,0.00021030557,0.00036586353,0.0062683607],"category_scores_gemma":[0.013561379,0.00010776351,0.00018183113,0.0054108943,0.0012822968,0.0010132771,0.0012918457,0.00061949965,0.00096248527],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009254325,0.0003774277,0.6649885,0.00065163366,0.00024864482,0.0023717158,0.100472346,0.0013169383,0.0048792125,0.02614229,0.012155389,0.1854705],"study_design_scores_gemma":[0.00001870508,0.00010494735,0.9375725,0.00033070045,0.00004468232,0.0006359175,0.030225258,0.0010468541,0.0005850993,0.0034119918,0.025974708,0.000048700807],"about_ca_topic_score_codex":0.0024585275,"about_ca_topic_score_gemma":0.004007597,"teacher_disagreement_score":0.0062683607,"about_ca_system_score_codex":0.00088140165,"about_ca_system_score_gemma":0.0006290037,"threshold_uncertainty_score":0.020969748},"labels":[],"label_agreement":null},{"id":"W2043955509","doi":"10.1080/18811248.2004.9726445","title":"Text Mining Analysis of Public Comments Regarding High-level Radioactive Waste Disposal","year":2005,"lang":"en","type":"article","venue":"Journal of Nuclear Science and Technology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Nuclear Waste Management Organization","keywords":"Radioactive waste; High-level waste; Promotion (chess); Reliability (semiconductor); Risk perception; Order (exchange); Spent nuclear fuel; Risk communication; Perception; Business; Risk analysis (engineering); Waste management; Psychology; Engineering; Political science; Finance; Law","score_opus":0.049617139880599126,"score_gpt":0.3484674406529522,"score_spread":0.2988503007723531,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2043955509","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9782144,0.00016775259,0.009795572,0.00045135192,0.000080440535,0.0008905446,0.0071254033,0.0002677253,0.003006725],"genre_scores_gemma":[0.9575015,0.0002879788,0.029052958,0.00013671955,0.000122211,0.0019305688,0.008067342,0.000046104244,0.002854607],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9970891,0.0013453282,0.00039556838,0.00026362803,0.0007605579,0.00014577985],"domain_scores_gemma":[0.9574576,0.034113005,0.0027180114,0.0007007454,0.004748902,0.00026174143],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028927622,0.00035136324,0.00038574354,0.003977822,0.0005628413,0.00073794596,0.00031732058,0.0004900304,0.0016989398],"category_scores_gemma":[0.015493578,0.00008112491,0.00024490766,0.003249784,0.00034295244,0.00075226923,0.00039493424,0.00041645975,0.00056879106],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036712778,0.0016308008,0.10580448,0.0064553795,0.00015861347,0.00387562,0.091857694,0.0033077365,0.14284588,0.0021513468,0.019698538,0.6185427],"study_design_scores_gemma":[0.00018336129,0.0026776753,0.6348436,0.001182578,0.00029110955,0.0022179016,0.12741354,0.074092016,0.09302943,0.0039385296,0.05984296,0.00028726042],"about_ca_topic_score_codex":0.0009621493,"about_ca_topic_score_gemma":0.0014457206,"teacher_disagreement_score":0.003977822,"about_ca_system_score_codex":0.0005740627,"about_ca_system_score_gemma":0.000577007,"threshold_uncertainty_score":0.015298545},"labels":[],"label_agreement":null},{"id":"W2070151749","doi":"10.1177/0306624x03257519","title":"Battered Woman Syndrome Testimony in Canada: Its Development and Lingering Issues","year":2003,"lang":"en","type":"article","venue":"International Journal of Offender Therapy and Comparative Criminology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Suicide prevention; Poison control; Injury prevention; Human factors and ergonomics; Occupational safety and health; Criminology; Medical emergency; Forensic engineering; Psychology; Psychiatry; Engineering; Political science; Medicine; Law","score_opus":0.37230989386312613,"score_gpt":0.3996743038979357,"score_spread":0.02736441003480955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2070151749","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25277275,0.1148889,0.00675005,0.48075652,0.0027406916,0.0006239121,0.0027781122,0.00024422523,0.13844483],"genre_scores_gemma":[0.8864335,0.06283066,0.012243576,0.024166366,0.0006048148,0.0002095481,0.00079845596,0.00011440752,0.012598626],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.9756589,0.0035546029,0.0013800703,0.001555401,0.015304743,0.0025463025],"domain_scores_gemma":[0.89812446,0.030362654,0.0036921427,0.0017520901,0.060329657,0.005739034],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027021863,0.00039577356,0.0007036756,0.009213639,0.014159594,0.0107056135,0.004812143,0.0034099987,0.0034707652],"category_scores_gemma":[0.08359337,0.0007581385,0.00039399246,0.010578027,0.009476918,0.0031290012,0.004406905,0.0034923807,0.00027368826],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015601021,0.00012746984,0.04727446,0.0021201167,0.00008492747,0.0022437174,0.056926116,0.001489041,0.001395465,0.16148849,0.09758519,0.629109],"study_design_scores_gemma":[0.000063503074,0.00017223184,0.18996914,0.006604314,0.00017744098,0.0020591435,0.07122202,0.003547128,0.0028501863,0.01488599,0.7080053,0.00044360818],"about_ca_topic_score_codex":0.98981094,"about_ca_topic_score_gemma":0.99531806,"teacher_disagreement_score":0.13871354,"about_ca_system_score_codex":0.13871354,"about_ca_system_score_gemma":0.2746474,"threshold_uncertainty_score":0.9989702},"labels":[],"label_agreement":null},{"id":"W2070320835","doi":"10.1002/asi.22797","title":"In their own image? a comparison of doctoral students' and faculty members' referencing behavior","year":2013,"lang":"en","type":"article","venue":"Journal of the American Society for Information Science and Technology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Doctoral dissertation; Library science; Psychology; University faculty; Sociology; Medical education; Higher education; Medicine; Political science; Computer science","score_opus":0.05346329054850051,"score_gpt":0.42973841528092743,"score_spread":0.3762751247324269,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2070320835","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9912025,0.0011406705,0.0005809635,0.0008030339,0.0000424998,0.000016922399,0.0000643086,0.000020110858,0.0061289454],"genre_scores_gemma":[0.99536645,0.0008566379,0.0005970088,0.00024889794,0.000067120425,0.000015365931,0.00009263422,0.000015833783,0.0027400127],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99639493,0.0016117329,0.00028321776,0.00025519892,0.0012173746,0.00023759995],"domain_scores_gemma":[0.9616044,0.019971669,0.008865598,0.0021199635,0.0039937235,0.0034445915],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.007929335,0.00020231666,0.00039526817,0.0033205526,0.0016889666,0.003210401,0.0005585313,0.00088046154,0.0038667948],"category_scores_gemma":[0.058056656,0.00018481222,0.0003403573,0.0025479281,0.00092609884,0.0019535515,0.001712295,0.00073380535,0.0009363752],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003344366,0.00029575618,0.5115168,0.0003647825,0.00016405634,0.00063232024,0.25599766,0.00012720212,0.006922673,0.0031078719,0.004471304,0.21606518],"study_design_scores_gemma":[0.000035493023,0.0005848764,0.65043414,0.00038089804,0.00013208277,0.0025086752,0.29380518,0.0008386973,0.003844169,0.0032901778,0.04403163,0.00011403894],"about_ca_topic_score_codex":0.0011757901,"about_ca_topic_score_gemma":0.0016165198,"teacher_disagreement_score":0.9966794,"about_ca_system_score_codex":0.0006489658,"about_ca_system_score_gemma":0.0008654114,"threshold_uncertainty_score":0.041934848},"labels":[],"label_agreement":null},{"id":"W2076133938","doi":"10.7202/013259ar","title":"Differences in News Translation between Broadcasting and Newspapers: A Case Study of Korean-English Translation1","year":2006,"lang":"en","type":"article","venue":"Meta Journal des traducteurs","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":50,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Newspaper; Linguistics; Translation (biology); Rendering (computer graphics); Broadcasting (networking); Literary translation; Computer science; Advertising; History; Media studies; Sociology; Artificial intelligence; Business","score_opus":0.12006771263630656,"score_gpt":0.348027203817123,"score_spread":0.22795949118081643,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2076133938","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99339056,0.0001622297,0.0006909362,0.00047252595,0.000017655499,0.00006133025,0.000039481718,0.000010259777,0.0051550106],"genre_scores_gemma":[0.99605954,0.00026030897,0.0015909387,0.00013628599,0.000016999273,0.00004116597,0.00005953485,0.00003606573,0.0017992968],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9886026,0.009022247,0.00055577443,0.00042194445,0.0008187041,0.0005788244],"domain_scores_gemma":[0.96099114,0.031013804,0.0027214251,0.0016338598,0.0026963535,0.0009433843],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0088230185,0.0004700961,0.00043387522,0.0012079524,0.004842316,0.0033413917,0.0010375531,0.0013724269,0.002964046],"category_scores_gemma":[0.0341279,0.00041626013,0.0003410451,0.0037875797,0.0028961692,0.0025662796,0.0018547995,0.0015650614,0.0005436064],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030372688,0.00044311557,0.02579662,0.0003134692,0.000020766456,0.013399135,0.9288678,0.00022476143,0.002527438,0.0026378613,0.00093744235,0.024527904],"study_design_scores_gemma":[0.00008932937,0.00039949553,0.034096252,0.00013381949,0.000060469214,0.0050660544,0.9358729,0.0010555804,0.0036982803,0.00089363067,0.018578297,0.000055945155],"about_ca_topic_score_codex":0.012230831,"about_ca_topic_score_gemma":0.024672987,"teacher_disagreement_score":0.012230831,"about_ca_system_score_codex":0.0029842544,"about_ca_system_score_gemma":0.0019206044,"threshold_uncertainty_score":0.04666114},"labels":[],"label_agreement":null},{"id":"W2077014275","doi":"10.3138/cjccj.2013.e44","title":"Beyond Frequency: Perceived Realism and the <i>CSI</i> Effect","year":2014,"lang":"en","type":"article","venue":"Canadian Journal of Criminology and Criminal Justice/La Revue canadienne de criminologie et de justice pénale","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Realism; Context (archaeology); Psychology; Social psychology; Moderation; Criminal justice; Economic Justice; Criminology; Political science; Law","score_opus":0.05552850342321045,"score_gpt":0.3268272035254285,"score_spread":0.271298700102218,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077014275","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.944891,0.00049556635,0.005421668,0.00097205787,0.00007771451,0.00016886913,0.00021461125,0.000069106485,0.04768948],"genre_scores_gemma":[0.99736565,0.00011021945,0.0013104253,0.00019849456,0.000055117587,0.00004959601,0.000078523975,0.000020071458,0.0008119291],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99517846,0.0027857625,0.00029495437,0.00044708833,0.0010661681,0.0002275862],"domain_scores_gemma":[0.8677313,0.108288184,0.013675056,0.0051510897,0.002794637,0.0023597288],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005912798,0.00035779344,0.00040724143,0.0009425733,0.0006235309,0.0022111193,0.00058849517,0.0009089654,0.008657443],"category_scores_gemma":[0.049334627,0.0003238487,0.0007673768,0.0006408396,0.0017941043,0.001417973,0.001592111,0.0019367776,0.00036525977],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004865502,0.0015793178,0.86761165,0.0011633037,0.001333686,0.00050675904,0.020060696,0.0021629722,0.023389498,0.01903209,0.0016389857,0.056655552],"study_design_scores_gemma":[0.00013917536,0.0009677597,0.9839401,0.00019707109,0.00032249108,0.00029350238,0.0031744754,0.0017384018,0.001833449,0.004572206,0.002752076,0.0000693184],"about_ca_topic_score_codex":0.001994388,"about_ca_topic_score_gemma":0.0019953393,"teacher_disagreement_score":0.9980056,"about_ca_system_score_codex":0.00072261604,"about_ca_system_score_gemma":0.00041410525,"threshold_uncertainty_score":0.031270206},"labels":[],"label_agreement":null},{"id":"W2140838853","doi":"10.3758/bf03196630","title":"The role of guessing and boundaries on date estimation biases","year":2004,"lang":"en","type":"article","venue":"Psychonomic Bulletin & Review","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Telescoping series; Psychology; Boundary (topology); Dissociation (chemistry); Event (particle physics); Social psychology; Statistics; Mathematics; Chemistry; Mathematical analysis","score_opus":0.036547883911637956,"score_gpt":0.38093139902908024,"score_spread":0.3443835151174423,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140838853","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28137589,0.080678634,0.5575039,0.017774103,0.0021954598,0.00019757584,0.0009077042,0.0012829822,0.0580837],"genre_scores_gemma":[0.92065847,0.013413569,0.059178278,0.001305953,0.0012715503,0.00010228137,0.000318186,0.00042970292,0.0033219424],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9875513,0.0068175476,0.0010743042,0.0018902835,0.0023058539,0.00036064602],"domain_scores_gemma":[0.5080205,0.45144892,0.0124632465,0.018753951,0.008548354,0.00076507044],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03551778,0.0006145882,0.0012851419,0.002796607,0.00073847285,0.0050720302,0.0021866737,0.0019466756,0.0054890634],"category_scores_gemma":[0.3354074,0.0006755888,0.0007799556,0.0020164358,0.0031977908,0.01382347,0.0018036822,0.0025172376,0.001584879],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001489461,0.0000837012,0.03118757,0.0018952388,0.00058494473,0.00022877193,0.0021202706,0.011946399,0.003999417,0.16239499,0.006444125,0.77762514],"study_design_scores_gemma":[0.0002385188,0.0002384517,0.072153464,0.0018396957,0.0010356538,0.0012600713,0.0015853957,0.08963823,0.025339717,0.7743537,0.032016713,0.00030048663],"about_ca_topic_score_codex":0.0009841865,"about_ca_topic_score_gemma":0.0009212716,"teacher_disagreement_score":0.03551778,"about_ca_system_score_codex":0.001172846,"about_ca_system_score_gemma":0.0010818477,"threshold_uncertainty_score":0.18783826},"labels":[],"label_agreement":null},{"id":"W2198225508","doi":"10.6084/m9.figshare.91828.v2","title":"Full Text of 207 Reports from 1st Quarter of 2012 on Looted Heritage","year":2012,"lang":"en","type":"article","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); History; Mathematics; Archaeology","score_opus":0.06727062302183935,"score_gpt":0.3515752677550471,"score_spread":0.28430464473320777,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2198225508","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039897314,0.00071779557,0.00069855386,0.00043162098,0.00044397725,0.000107008054,0.9576256,0.0017637019,0.034221955],"genre_scores_gemma":[0.014860185,0.001263447,0.002435698,0.00018465318,0.00044498764,0.000340287,0.9147695,0.0012722614,0.064428955],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99865377,0.00012823602,0.00015413553,0.00021068876,0.0007033093,0.00014980047],"domain_scores_gemma":[0.9911998,0.0025563277,0.0010735965,0.0007860324,0.0038923435,0.0004919707],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009503596,0.001085949,0.0006735127,0.019207561,0.0012591316,0.002722835,0.00074799656,0.0006248147,0.17914496],"category_scores_gemma":[0.008392159,0.00047201387,0.000542492,0.024713516,0.00034902242,0.0013576736,0.0017035105,0.0005514614,0.110420324],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007574541,0.000013903182,0.0018413571,0.0007005953,0.000016805596,0.00009622958,0.0002443714,0.00016472889,0.00036511378,0.00043670795,0.97196275,0.024081651],"study_design_scores_gemma":[0.000019680621,0.000012755281,0.014516405,0.0003391967,0.000030323636,0.00010011167,0.00070779363,0.000195025,0.0007856495,0.00034403693,0.9829208,0.000028149254],"about_ca_topic_score_codex":0.026754776,"about_ca_topic_score_gemma":0.036491435,"teacher_disagreement_score":0.17914496,"about_ca_system_score_codex":0.00096204027,"about_ca_system_score_gemma":0.0027581982,"threshold_uncertainty_score":0.5992996},"labels":[],"label_agreement":null},{"id":"W2257785951","doi":"10.1016/j.shpsc.2015.12.016","title":"What are narratives good for?","year":2016,"lang":"en","type":"article","venue":"Studies in History and Philosophy of Science Part C Studies in History and Philosophy of Biological and Biomedical Sciences","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":52,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Narrative; Contingency; Narrative criticism; Narrative network; Narrative inquiry; Natural (archaeology); Epistemology; History; Sociology; Aesthetics; Literature; Art; Philosophy","score_opus":0.31218757050064067,"score_gpt":0.4168443495923639,"score_spread":0.10465677909172322,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2257785951","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039900657,0.036352642,0.015216506,0.4853668,0.0038774437,0.00010286419,0.0004948311,0.00013547768,0.4185528],"genre_scores_gemma":[0.9429261,0.0136237,0.005788289,0.017095236,0.0017807238,0.00020221886,0.0002625018,0.00030201525,0.018019255],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98475754,0.011430098,0.0004557199,0.0009198665,0.0015428587,0.0008938451],"domain_scores_gemma":[0.9582054,0.02932285,0.003691886,0.0029942575,0.0029811263,0.0028044847],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014118112,0.0009007938,0.0010933345,0.004632466,0.012413334,0.027967378,0.0018416817,0.0055683805,0.01434735],"category_scores_gemma":[0.05328663,0.0005230306,0.0004271507,0.0050097685,0.04833294,0.05108801,0.0056163203,0.0063243504,0.0018686817],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023780922,0.000009676824,0.0010606153,0.00017425354,0.000015194367,0.000111772475,0.07481726,0.000043376003,0.000054287422,0.90283877,0.009908748,0.010942151],"study_design_scores_gemma":[0.000016825612,0.000008775069,0.0007668342,0.001102526,0.000018209921,0.00017816943,0.10119543,0.00010692802,0.00016749559,0.6204387,0.27597517,0.000024928662],"about_ca_topic_score_codex":0.006228726,"about_ca_topic_score_gemma":0.006674569,"teacher_disagreement_score":0.027967378,"about_ca_system_score_codex":0.009058119,"about_ca_system_score_gemma":0.0076606236,"threshold_uncertainty_score":0.07466459},"labels":[],"label_agreement":null},{"id":"W2262872440","doi":"","title":"Live web cast from Whitehorse, Yukon on www.citizenvoices.gg.ca","year":2018,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"The Internet; World Wide Web; Art; Geology; Computer science","score_opus":0.04658103359088428,"score_gpt":0.37174463849244566,"score_spread":0.3251636049015614,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2262872440","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020235354,0.0005547287,0.0045626787,0.0015844204,0.0008934781,0.0002295098,0.4367666,0.024837077,0.51033616],"genre_scores_gemma":[0.044916913,0.00043278866,0.005930087,0.00039687302,0.0001464048,0.00013953066,0.37910318,0.01230489,0.55662936],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9998299,0.000012463407,0.000005542843,0.00003374871,0.00007404539,0.000044271103],"domain_scores_gemma":[0.99938595,0.00008330471,0.000016829064,0.00017277342,0.0001968766,0.00014420087],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00023674403,0.00046057653,0.00049724005,0.0012545933,0.0016340347,0.002126707,0.0005646535,0.0007253838,0.35221082],"category_scores_gemma":[0.0012170393,0.00035375785,0.00030617477,0.0021308518,0.00028327748,0.0016314619,0.0021096948,0.00091956905,0.16648693],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009805636,0.00003250229,0.0009513351,0.00007963627,0.000008451338,0.00011391107,0.00026243745,0.00015154885,0.0003710443,0.0011469421,0.9736077,0.02317639],"study_design_scores_gemma":[0.000024488198,0.00001263587,0.0051997737,0.00007913652,0.000006284023,0.00005848086,0.00047654545,0.0006476029,0.00046717116,0.0012848189,0.9917269,0.000016103722],"about_ca_topic_score_codex":0.07211455,"about_ca_topic_score_gemma":0.2500022,"teacher_disagreement_score":0.9278855,"about_ca_system_score_codex":0.0005140746,"about_ca_system_score_gemma":0.0010295312,"threshold_uncertainty_score":0.92399263},"labels":[],"label_agreement":null},{"id":"W2282393044","doi":"10.1111/1468-4446.12170","title":"Tavory, I.and Timmermans, S.Abductive Analysis: Theorizing Qualitative Research2014 The University of Chicago Press 172 pp. $19.00 (paperback)","year":2016,"lang":"en","type":"article","venue":"British Journal of Sociology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Citation; Library science; Qualitative analysis; Sociology; Computer science; Qualitative research; Social science","score_opus":0.05535632878154162,"score_gpt":0.388017768337033,"score_spread":0.3326614395554914,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2282393044","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003295219,0.6383754,0.123034194,0.14428173,0.008389973,0.0004116823,0.0016740434,0.00061832723,0.07991947],"genre_scores_gemma":[0.06905448,0.7255726,0.13522376,0.013931068,0.0046965154,0.0014302678,0.0017729274,0.0011327685,0.047185678],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9932086,0.0034335006,0.0007163923,0.00048540212,0.0019507521,0.0002052748],"domain_scores_gemma":[0.9024017,0.08638974,0.0019294544,0.0021679087,0.006173253,0.00093787175],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01923451,0.0014838227,0.0015738598,0.011369435,0.004154796,0.009732496,0.0023782074,0.0032592027,0.028571628],"category_scores_gemma":[0.05745254,0.00231896,0.0012065971,0.009947698,0.014070366,0.021299139,0.0039586998,0.0063456227,0.009492431],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013128201,0.000076822405,0.001415522,0.0044964394,0.0000972765,0.0002720141,0.015357903,0.00052761566,0.00055519614,0.19280174,0.38767603,0.3965923],"study_design_scores_gemma":[0.000044643388,0.000052309413,0.0027037458,0.008480727,0.00012979514,0.00038074295,0.007981876,0.0006536729,0.00094069034,0.45255747,0.5259355,0.00013886408],"about_ca_topic_score_codex":0.011538152,"about_ca_topic_score_gemma":0.016672159,"teacher_disagreement_score":0.028571628,"about_ca_system_score_codex":0.0048110285,"about_ca_system_score_gemma":0.0057494123,"threshold_uncertainty_score":0.101723015},"labels":[],"label_agreement":null},{"id":"W2352340675","doi":"","title":"Safer sex strategies as risk reduction: Use of Latent Class Analysis approach to examine use of safe sex strategies among gay, bisexual and men who have sex with men in Toronto, Canada","year":2015,"lang":"en","type":"article","venue":"2015 APHA Annual Meeting & Expo (Oct. 31 - Nov. 4, 2015)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Men who have sex with men; Safer sex; Latent class model; Demography; Homosexuality; Psychology; Gender studies; Medicine; Sociology; Human immunodeficiency virus (HIV); Condom; Computer science; Syphilis","score_opus":0.06457649244237476,"score_gpt":0.3461747912382602,"score_spread":0.2815982987958855,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2352340675","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99074733,0.00038870267,0.004105372,0.0009660168,0.000034009616,0.0004354528,0.0019226082,0.000027253056,0.0013732755],"genre_scores_gemma":[0.9924389,0.00024374384,0.0045022247,0.00005658365,0.000010209539,0.00038907604,0.0011789874,0.000015587031,0.0011646774],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99721575,0.001559051,0.00013963672,0.00028747605,0.0004602581,0.00033776733],"domain_scores_gemma":[0.9956814,0.0019519932,0.000508511,0.0003396853,0.0009112801,0.00060712104],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038202496,0.0006542216,0.0006940663,0.0020186065,0.0035962996,0.002469567,0.0017771748,0.00061777065,0.002735313],"category_scores_gemma":[0.011003878,0.0003674067,0.0018749323,0.002566398,0.001060555,0.0007781372,0.0018126095,0.0019287897,0.0001539355],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025490255,0.0003775063,0.95664364,0.00010333794,0.00042216212,0.00004738457,0.011325212,0.0013945115,0.00020640632,0.0015333829,0.0019483931,0.025743267],"study_design_scores_gemma":[0.00006832966,0.0001672493,0.93758893,0.00015120914,0.00036205625,0.000039571863,0.025231492,0.0330099,0.00022956131,0.0013951538,0.0016856709,0.000070826245],"about_ca_topic_score_codex":0.96542037,"about_ca_topic_score_gemma":0.9770179,"teacher_disagreement_score":0.034579635,"about_ca_system_score_codex":0.017276416,"about_ca_system_score_gemma":0.031416155,"threshold_uncertainty_score":0.12534976},"labels":[],"label_agreement":null},{"id":"W2406594196","doi":"10.5121/csit.2016.60616","title":"A Text Mining Research Based on LDA Topic Modelling","year":2016,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":174,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Acadia University","funders":"","keywords":"Computer science; Topic model; Natural language processing; Artificial intelligence; Information retrieval","score_opus":0.3539824256636802,"score_gpt":0.5065979207347818,"score_spread":0.15261549507110161,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2406594196","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014725449,0.008525891,0.9659724,0.002081823,0.0005587631,0.00025027996,0.0009532176,0.0013785288,0.0055535748],"genre_scores_gemma":[0.33256823,0.018668426,0.6264296,0.0010047525,0.0026726304,0.001128232,0.0039348267,0.00059705187,0.012996231],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9968035,0.0011755765,0.00021473473,0.0009044542,0.00078177825,0.000119981305],"domain_scores_gemma":[0.9944542,0.0034982741,0.00031487888,0.0005867136,0.001032457,0.00011351888],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037353458,0.0012650213,0.0014405986,0.0075659333,0.0013698485,0.0039361417,0.0015354063,0.0013811792,0.001871652],"category_scores_gemma":[0.010921673,0.00062635174,0.0020778042,0.0101543665,0.0010017334,0.006663283,0.001218205,0.0020129958,0.002445176],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002614462,0.0004134879,0.010904943,0.0018600133,0.0004859987,0.0003331419,0.0017964591,0.021220926,0.009991318,0.06975954,0.020955937,0.8620168],"study_design_scores_gemma":[0.00007406251,0.00033470208,0.009266604,0.0005778982,0.0004038217,0.0013605361,0.0015758881,0.72433305,0.015116581,0.13626884,0.11041947,0.0002686492],"about_ca_topic_score_codex":0.0024756512,"about_ca_topic_score_gemma":0.001864415,"teacher_disagreement_score":0.0075659333,"about_ca_system_score_codex":0.0010992148,"about_ca_system_score_gemma":0.0013210098,"threshold_uncertainty_score":0.019754648},"labels":[],"label_agreement":null},{"id":"W2468532032","doi":"10.1017/s000842391600055x","title":"L'analyse automatisée du ton médiatique : construction et utilisation de la version française du<i>Lexicoder Sentiment Dictionary</i>","year":2016,"lang":"fr","type":"article","venue":"Canadian Journal of Political Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval","funders":"","keywords":"Humanities; Ton; Political science; Philosophy; Art; History","score_opus":0.012991376310666223,"score_gpt":0.3136421237604521,"score_spread":0.30065074744978587,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2468532032","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5325335,0.0018053107,0.28561103,0.0031961973,0.0010458576,0.0015850702,0.067612685,0.0047331676,0.10187701],"genre_scores_gemma":[0.6050329,0.0011736723,0.31814152,0.00043379082,0.00015652747,0.001405135,0.04093541,0.001799151,0.03092182],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9968432,0.0010213022,0.00056266366,0.00063350843,0.0007793327,0.00015996199],"domain_scores_gemma":[0.9842121,0.0054477477,0.0011446882,0.0015549774,0.0074252267,0.00021538638],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003979304,0.0005791887,0.00037711608,0.0052397316,0.00123805,0.0032824166,0.000422933,0.0003291844,0.008893956],"category_scores_gemma":[0.015487345,0.0003606454,0.00033519478,0.0053195953,0.0010571495,0.002195816,0.0016260225,0.00086504535,0.0033783717],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048692574,0.00009337097,0.07383731,0.001865175,0.00014362659,0.0005301542,0.037947334,0.0014417424,0.05617168,0.024664281,0.051937394,0.75088114],"study_design_scores_gemma":[0.00007052867,0.00017455965,0.1735667,0.0011316316,0.00016753444,0.0008736568,0.034869663,0.016256915,0.044937667,0.005546318,0.7221721,0.00023284688],"about_ca_topic_score_codex":0.07556447,"about_ca_topic_score_gemma":0.099148475,"teacher_disagreement_score":0.07556447,"about_ca_system_score_codex":0.0023639232,"about_ca_system_score_gemma":0.0048154504,"threshold_uncertainty_score":0.1502493},"labels":[],"label_agreement":null},{"id":"W2477109771","doi":"10.4018/978-1-4666-4999-6.ch020","title":"Reliability and Validity in Automated Content Analysis","year":2014,"lang":"en","type":"book-chapter","venue":"Advances in linguistics and communication studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Diction; Reliability (semiconductor); Content (measure theory); Content validity; Volume (thermodynamics); Computer science; Validity; Data science; Statistics; Linguistics; Mathematics; Philosophy; Psychometrics","score_opus":0.1640921458624373,"score_gpt":0.44947153446181404,"score_spread":0.2853793885993767,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2477109771","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04209846,0.019403826,0.73768,0.013464695,0.0015003593,0.0025596146,0.0008077083,0.0015359768,0.1809494],"genre_scores_gemma":[0.48310083,0.0073302356,0.4900938,0.0021285657,0.0016803576,0.0050776224,0.0011238859,0.001282342,0.008182294],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6708732,0.23383127,0.015721247,0.016256953,0.061227184,0.0020900755],"domain_scores_gemma":[0.30264273,0.57021874,0.014957306,0.053979985,0.05723653,0.00096470554],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.22375508,0.0014529494,0.002233883,0.021325763,0.004417751,0.017097542,0.0035580094,0.0027104318,0.0049269316],"category_scores_gemma":[0.52361566,0.001916668,0.0019449234,0.017783439,0.024294537,0.021817613,0.01142912,0.005048086,0.0026776716],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012740208,0.00009940448,0.01457863,0.0020939498,0.0003763266,0.0001538406,0.03155476,0.003756921,0.00080944906,0.59530216,0.012841732,0.33830544],"study_design_scores_gemma":[0.000054056953,0.00010697511,0.014237989,0.0036107323,0.00013634092,0.00037864153,0.0072432086,0.0178704,0.0018657218,0.88894993,0.06535082,0.00019523584],"about_ca_topic_score_codex":0.005002895,"about_ca_topic_score_gemma":0.0030568196,"teacher_disagreement_score":0.22375508,"about_ca_system_score_codex":0.007900943,"about_ca_system_score_gemma":0.00812961,"threshold_uncertainty_score":0.9572482},"labels":[],"label_agreement":null},{"id":"W2478027989","doi":"10.1177/0049124116661575","title":"A Novel Sequential Mixed-method Technique for Contrastive Analysis of Unscripted Qualitative Data","year":2016,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"NeuroDevNet; University of British Columbia","funders":"","keywords":"Computer science; Multimethodology; Qualitative research; Qualitative property; Subject (documents); Data science; Contrastive analysis; Psychology; Linguistics; Mathematics education; Machine learning; Sociology; World Wide Web; Social science","score_opus":0.6465089207335274,"score_gpt":0.6967122529922157,"score_spread":0.05020333225868834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2478027989","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029561128,0.00006445442,0.9790315,0.00013995837,0.0002093292,0.0142218275,0.0005015,0.00082891405,0.0020464787],"genre_scores_gemma":[0.007341634,0.00002810428,0.94233906,0.0000957362,0.000037207345,0.049357798,0.00013153638,0.00021139489,0.0004575312],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8098165,0.15145557,0.007825671,0.016595654,0.013145595,0.001161047],"domain_scores_gemma":[0.68397367,0.2463913,0.013741343,0.030530293,0.024149938,0.0012135046],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11072115,0.0038440626,0.003013406,0.0077075595,0.0041068527,0.005726018,0.0054966644,0.002223079,0.024297403],"category_scores_gemma":[0.24582782,0.0022610386,0.003492907,0.008246874,0.00477624,0.003196929,0.0069487686,0.004993264,0.0037035597],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026713947,0.0012302052,0.0039249943,0.0083706975,0.0016726259,0.000590719,0.04234854,0.008973056,0.025566585,0.16661249,0.014729532,0.7233091],"study_design_scores_gemma":[0.0048182528,0.0055153943,0.011898424,0.0036781102,0.0019304384,0.000985616,0.011324893,0.2048148,0.06432299,0.4077209,0.2817275,0.0012626604],"about_ca_topic_score_codex":0.0024921303,"about_ca_topic_score_gemma":0.0047523463,"teacher_disagreement_score":0.8892788,"about_ca_system_score_codex":0.0043325922,"about_ca_system_score_gemma":0.0073040086,"threshold_uncertainty_score":0.5855564},"labels":[],"label_agreement":null},{"id":"W2487945793","doi":"10.6000/1929-6002.2016.05.02.2","title":"Trend Topic Analysis for Wind Energy Researches: A Data Mining Approach Using Text Mining","year":2016,"lang":"en","type":"article","venue":"Journal of Technology Innovations in Renewable Energy","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Data mining; Computer science; Wind power; Data science; Engineering; Electrical engineering","score_opus":0.1723094780900471,"score_gpt":0.4166322562241974,"score_spread":0.24432277813415032,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2487945793","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08259137,0.009166307,0.87876296,0.003044059,0.0005460425,0.0019428672,0.013831453,0.0038751855,0.0062397704],"genre_scores_gemma":[0.21974553,0.0064119995,0.7573087,0.00028876352,0.00083245145,0.0017774906,0.011525606,0.00024934273,0.0018600976],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9971372,0.0008849698,0.0005959679,0.0005809178,0.0007176792,0.00008318863],"domain_scores_gemma":[0.9889981,0.0081952745,0.0010361852,0.0004284011,0.0011825715,0.00015943474],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0041958275,0.0012525581,0.0013457452,0.018070182,0.001131073,0.003796026,0.0012473096,0.0010602449,0.0018606192],"category_scores_gemma":[0.014082894,0.00039957193,0.0020884492,0.0136799775,0.0006273591,0.0042257225,0.0011219954,0.0014486616,0.0013053188],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033548096,0.00047898537,0.04768693,0.0044999304,0.0008281308,0.0011221778,0.0030254568,0.014504062,0.011940391,0.016445367,0.018003205,0.88112986],"study_design_scores_gemma":[0.0002108521,0.00093721645,0.09039884,0.0031447536,0.0020040567,0.0037482402,0.011784754,0.5865855,0.024338698,0.12748484,0.14886817,0.0004939839],"about_ca_topic_score_codex":0.0019932038,"about_ca_topic_score_gemma":0.00240926,"teacher_disagreement_score":0.98192984,"about_ca_system_score_codex":0.000821202,"about_ca_system_score_gemma":0.0013186705,"threshold_uncertainty_score":0.022189915},"labels":[],"label_agreement":null},{"id":"W2517529746","doi":"10.5691/jjb.28.s3","title":"Papers Celebrating the 25th Anniversary of Biometric Society of Japan Contribution to Human Society: Experience of a Quarter of a Century and the Future Prospects Major Activities of Biometric Society of Japan and Japanese Biostatisticians —Past, Present and Future—","year":2007,"lang":"en","type":"article","venue":"Japanese Journal of Biometrics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Biometrics; Quarter (Canadian coin); Encyclopedia; Period (music); Library science; Social science; History; Sociology; Computer science; Artificial intelligence; Art","score_opus":0.012222835494847565,"score_gpt":0.3050107893503742,"score_spread":0.29278795385552664,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2517529746","genre_codex":"review","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.053667054,0.33346725,0.0019010764,0.2461303,0.2739852,0.00015249568,0.0030298836,0.0002755082,0.08739129],"genre_scores_gemma":[0.18462166,0.20304574,0.004127947,0.022540707,0.1446109,0.00026837902,0.003381456,0.0005216286,0.4368816],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99553263,0.0006678486,0.0005541419,0.0004889487,0.002203457,0.00055303617],"domain_scores_gemma":[0.9689164,0.0023164898,0.0030750115,0.0011561774,0.015273895,0.009261936],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013181281,0.00097272603,0.001005674,0.005809204,0.004717395,0.009992854,0.0014544313,0.0030513867,0.023891285],"category_scores_gemma":[0.023015171,0.00042377668,0.0008640486,0.009981128,0.0018830156,0.005700388,0.0042299223,0.0022526574,0.006863804],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018426422,0.00008471253,0.01349564,0.0014181491,0.00008246592,0.0010147817,0.008668534,0.00016481745,0.0011947583,0.012271138,0.7946783,0.16674247],"study_design_scores_gemma":[0.000006499615,0.0000488447,0.018977826,0.00035099898,0.000026054231,0.00036093965,0.0031698914,0.000045109515,0.00025656598,0.00085433474,0.97587323,0.000029821345],"about_ca_topic_score_codex":0.007371901,"about_ca_topic_score_gemma":0.016956752,"teacher_disagreement_score":0.023891285,"about_ca_system_score_codex":0.005328658,"about_ca_system_score_gemma":0.005889307,"threshold_uncertainty_score":0.079924345},"labels":[],"label_agreement":null},{"id":"W2518828969","doi":"10.5430/elr.v5n3p15","title":"The Study on Thematic Progression Patterns of English News","year":2016,"lang":"en","type":"article","venue":"English Linguistics Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Theme (computing); Thematic structure; Coherence (philosophical gambling strategy); Reading (process); Thematic analysis; Thematic map; Linguistics; Sociology; Computer science; Qualitative research; Social science; World Wide Web; Geography; Mathematics","score_opus":0.14595461313035335,"score_gpt":0.5053230660262403,"score_spread":0.359368452895887,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2518828969","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9330132,0.0010670591,0.018822877,0.00092819746,0.00009510159,0.00023290329,0.0007223672,0.00008427825,0.045033995],"genre_scores_gemma":[0.986684,0.0006107975,0.0070815748,0.00004127586,0.000051863342,0.00013359025,0.0004250173,0.000036171765,0.0049356217],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.99823916,0.0008981872,0.00016399282,0.00018637897,0.00038410723,0.00012811678],"domain_scores_gemma":[0.98910403,0.006537559,0.0014200446,0.00044737413,0.002208528,0.0002824539],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002432811,0.0002249545,0.00019336521,0.0045644343,0.0015118143,0.0021889075,0.00033547613,0.00026651626,0.0024533162],"category_scores_gemma":[0.014597496,0.00015763094,0.00028983792,0.005110991,0.0011756367,0.0030927425,0.0008162195,0.00055565947,0.0003569322],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007375886,0.00020648951,0.120989904,0.0014885255,0.000073011164,0.002104973,0.4895993,0.0006405702,0.017510809,0.05671725,0.0047550392,0.30517656],"study_design_scores_gemma":[0.000070119146,0.0003424721,0.3928359,0.0008954459,0.00016396676,0.0037268677,0.39768937,0.012628521,0.011060482,0.02704467,0.15341698,0.00012531219],"about_ca_topic_score_codex":0.0042645372,"about_ca_topic_score_gemma":0.004118205,"teacher_disagreement_score":0.0045644343,"about_ca_system_score_codex":0.0010325178,"about_ca_system_score_gemma":0.0009320723,"threshold_uncertainty_score":0.01286608},"labels":[],"label_agreement":null},{"id":"W2541026502","doi":"10.1080/14615517.2016.1239496","title":"Automated content analysis as a tool for research and practice: a case illustration from the Prairie Creek and Nico environmental assessments in the Northwest Territories, Canada","year":2016,"lang":"en","type":"article","venue":"Impact Assessment and Project Appraisal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Alberta","funders":"Networks of Centres of Excellence of Canada; Aurora Research Institute","keywords":"Public engagement; Scripting language; Sustainability; Content analysis; Public participation; Interpretation (philosophy); Environmental impact assessment; Politics; Environmental resource management; Environmental planning; Political science; Sociology; Public relations; Environmental science; Computer science; Law; Ecology; Social science","score_opus":0.17230422399094839,"score_gpt":0.5347691330615204,"score_spread":0.36246490907057205,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2541026502","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8223684,0.0021779432,0.042583134,0.03367357,0.00023585041,0.0040063397,0.00094639114,0.00020721472,0.09380115],"genre_scores_gemma":[0.9319166,0.0018585984,0.049855117,0.0018913351,0.000055682627,0.0015482752,0.00030950006,0.00013385457,0.012431087],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9677549,0.021954063,0.0010013692,0.0011643802,0.0053259465,0.0027993661],"domain_scores_gemma":[0.94036883,0.04258337,0.00167532,0.0023313235,0.010792357,0.0022487873],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025318103,0.0007082451,0.000522596,0.004975379,0.03079807,0.008937883,0.003747832,0.0026255758,0.0021223035],"category_scores_gemma":[0.036309216,0.000537891,0.000436376,0.008278129,0.01383593,0.0026928,0.0064524724,0.0027458665,0.0003390158],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004610146,0.00012558834,0.008817047,0.00049864704,0.000017845285,0.006725075,0.90449715,0.0008054408,0.0017649581,0.016015256,0.007292944,0.053393934],"study_design_scores_gemma":[0.000013674271,0.00003624612,0.007723625,0.0005773055,0.000022293965,0.0007223269,0.90691966,0.0017995691,0.0012244955,0.0031985247,0.0777085,0.000053632037],"about_ca_topic_score_codex":0.8358366,"about_ca_topic_score_gemma":0.9417961,"teacher_disagreement_score":0.16416341,"about_ca_system_score_codex":0.06395447,"about_ca_system_score_gemma":0.08968672,"threshold_uncertainty_score":0.46402436},"labels":[],"label_agreement":null},{"id":"W2553199347","doi":"","title":"Digital Public-Administration Research Drawing from Bayesian Inspiration : Latent Trait Scaling and Topic Modeling Examination of Budgetary Legislation in Thirteen Countries","year":2016,"lang":"en","type":"article","venue":"Työväentutkimus Vuosikirja","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Legislation; Government (linguistics); Political science; German; Public administration; Law; Geography","score_opus":0.09582127767403786,"score_gpt":0.3689485248040414,"score_spread":0.2731272471300035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2553199347","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8996149,0.000990213,0.08213735,0.0017265733,0.000027685663,0.00010733566,0.00043002595,0.00005352729,0.0149124665],"genre_scores_gemma":[0.98099387,0.0003860872,0.017555915,0.00006223651,0.000019664174,0.00009228528,0.00031469882,0.00001663295,0.000558595],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9932447,0.0050817877,0.00028899068,0.00060069095,0.00060222275,0.00018158855],"domain_scores_gemma":[0.95308155,0.039629977,0.0036363243,0.0019709058,0.001261029,0.00042032715],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0081903385,0.00020940816,0.00044469646,0.004317028,0.0013684507,0.0040225754,0.00054423115,0.00059666764,0.0022446048],"category_scores_gemma":[0.040191453,0.00030288097,0.0006005169,0.009004284,0.0023172041,0.003885462,0.0020584096,0.0010931403,0.00022707411],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026580697,0.0004093249,0.3397168,0.00056997605,0.00042334778,0.00026747686,0.06602446,0.02522957,0.0013800119,0.31145096,0.00262083,0.25164145],"study_design_scores_gemma":[0.000075049,0.00018622838,0.41532657,0.00072157924,0.00026496273,0.00029283285,0.07068047,0.23579073,0.0024515472,0.23939869,0.034677383,0.00013405074],"about_ca_topic_score_codex":0.007451105,"about_ca_topic_score_gemma":0.008628012,"teacher_disagreement_score":0.0081903385,"about_ca_system_score_codex":0.0022869285,"about_ca_system_score_gemma":0.00160118,"threshold_uncertainty_score":0.043315172},"labels":[],"label_agreement":null},{"id":"W2557534673","doi":"10.22230/src.2016v7n2/3a256","title":"Humanities Research Software Design: The Wilde Trials Web App","year":2016,"lang":"en","type":"article","venue":"Scholarly and Research Communication","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Newspaper; Web application; Software; World Wide Web; Media studies; Computer science; Political science; Sociology","score_opus":0.6430838273719559,"score_gpt":0.5680062877543386,"score_spread":0.07507753961761732,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2557534673","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021820314,0.00075166905,0.8047236,0.009669648,0.0010026629,0.01210157,0.015000834,0.049556848,0.08537289],"genre_scores_gemma":[0.07287255,0.00059313705,0.85775685,0.0020568334,0.0004615696,0.02331554,0.006393704,0.006297902,0.030251885],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9887333,0.0074630366,0.000858358,0.0013824069,0.0013732103,0.00018966402],"domain_scores_gemma":[0.9309918,0.052357648,0.001874261,0.007850327,0.005201836,0.0017240101],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.019526083,0.0006247319,0.00061712565,0.0030871287,0.0016993758,0.004773729,0.0021110415,0.0010534439,0.049363676],"category_scores_gemma":[0.047817484,0.0008533229,0.00082969514,0.0020509064,0.002185799,0.004242314,0.0043622907,0.0017072895,0.016537333],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00096361496,0.0008684995,0.008260952,0.0032134575,0.0002755424,0.0013088626,0.022672763,0.0035534624,0.0062033534,0.09417333,0.29214138,0.56636477],"study_design_scores_gemma":[0.00075597916,0.0004295574,0.0067456677,0.0010413581,0.00011563789,0.0008463805,0.0053528254,0.019085204,0.0061561717,0.1370918,0.82221246,0.00016685095],"about_ca_topic_score_codex":0.0011105114,"about_ca_topic_score_gemma":0.002493987,"teacher_disagreement_score":0.99522626,"about_ca_system_score_codex":0.0009703665,"about_ca_system_score_gemma":0.003391211,"threshold_uncertainty_score":0.16513795},"labels":[],"label_agreement":null},{"id":"W2559591917","doi":"10.1057/978-1-137-59569-0_6","title":"Remediation and the Development of Modernist Forms in The Western Home Monthly","year":2016,"lang":"en","type":"book-chapter","venue":"Palgrave Macmillan UK eBooks","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Middlebrow; Scholarship; Affordance; Aesthetics; History; Media studies; Sociology; Visual arts; Art; Political science; Psychology; Law","score_opus":0.036204064071946825,"score_gpt":0.296592673212542,"score_spread":0.2603886091405952,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2559591917","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34820157,0.015818568,0.004862779,0.0082180975,0.0005043902,0.000049805316,0.00024172258,0.00021417404,0.62188894],"genre_scores_gemma":[0.91770333,0.0043366803,0.002577234,0.0004039296,0.00023760792,0.00001656618,0.00010850953,0.00011430174,0.07450174],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.99931276,0.00016628458,0.000022511127,0.00009138568,0.0003035891,0.00010348326],"domain_scores_gemma":[0.99935204,0.00025575527,0.00012103233,0.0000765857,0.00012000791,0.00007461644],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00067173154,0.00027929372,0.00019267488,0.0029316884,0.0046201996,0.0064248806,0.00045533196,0.00055793085,0.006133195],"category_scores_gemma":[0.0018539167,0.00015061135,0.00013036057,0.0034215786,0.012810548,0.0031098612,0.0017572474,0.0011072124,0.00046619945],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000059965852,0.000028002612,0.004796801,0.00022668342,0.000009650404,0.00079649815,0.30258527,0.0001726958,0.0010784938,0.5434411,0.015344156,0.13146064],"study_design_scores_gemma":[0.0000067805304,0.000019661793,0.020842377,0.000262028,0.000011883451,0.0007519456,0.07248251,0.00027211828,0.0011122006,0.032514293,0.8717031,0.00002103464],"about_ca_topic_score_codex":0.085661784,"about_ca_topic_score_gemma":0.2577598,"teacher_disagreement_score":0.085661784,"about_ca_system_score_codex":0.0067723775,"about_ca_system_score_gemma":0.003239755,"threshold_uncertainty_score":0.17032635},"labels":[],"label_agreement":null},{"id":"W2567467453","doi":"10.18653/v1/d16-1148","title":"Analyzing Framing through the Casts of Characters in the News","year":2016,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":64,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; University of Washington","keywords":"Framing (construction); Computer science; History; Archaeology","score_opus":0.0615801185775051,"score_gpt":0.3893943235540798,"score_spread":0.3278142049765747,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2567467453","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7446055,0.00083571486,0.23597158,0.00083150144,0.00009868915,0.00007696188,0.0027752821,0.00096918934,0.013835532],"genre_scores_gemma":[0.9736623,0.00021949474,0.0216476,0.000042676,0.000081285354,0.00005159514,0.0021115106,0.000087965054,0.0020956814],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9992956,0.0002845148,0.000028106966,0.00018258626,0.00011343539,0.00009572828],"domain_scores_gemma":[0.99615496,0.0021024197,0.0007412348,0.00046302684,0.000365788,0.00017256026],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008691968,0.00053184084,0.00035200443,0.0035243325,0.0007144871,0.0019785038,0.00044362195,0.00064106804,0.001985082],"category_scores_gemma":[0.00721535,0.00034850373,0.00041768193,0.0025936263,0.0006822362,0.0019642836,0.0008889862,0.0012004542,0.0008835925],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014533616,0.0006563302,0.30005875,0.00045659495,0.00034937574,0.0010777501,0.0095814215,0.0985759,0.039325435,0.074718855,0.015358512,0.45838776],"study_design_scores_gemma":[0.000035506062,0.00013894969,0.14631197,0.00010476477,0.00015904974,0.0003756283,0.0029003532,0.7637655,0.013310222,0.0538444,0.018960586,0.000093029295],"about_ca_topic_score_codex":0.0066322545,"about_ca_topic_score_gemma":0.011747756,"teacher_disagreement_score":0.0066322545,"about_ca_system_score_codex":0.00063496095,"about_ca_system_score_gemma":0.0004268106,"threshold_uncertainty_score":0.013187349},"labels":[],"label_agreement":null},{"id":"W2578588058","doi":"10.1017/s0008423916001165","title":"Digitization of the Canadian Parliamentary Debates","year":2017,"lang":"en","type":"article","venue":"Canadian Journal of Political Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":56,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Digitization; House of Commons; Political science; Architecture; Politics; Commons; Public administration; Library science; Media studies; Computer science; Sociology; Geography; Law; Telecommunications; Parliament; Archaeology","score_opus":0.04302063556107077,"score_gpt":0.36485329803137256,"score_spread":0.3218326624703018,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2578588058","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19298324,0.022452971,0.012508265,0.016615318,0.0017150317,0.0009415001,0.19296545,0.0012788633,0.55853933],"genre_scores_gemma":[0.758527,0.014514293,0.02785986,0.0021103604,0.00049031025,0.0008148491,0.07882314,0.0007846752,0.11607552],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9922996,0.00069832796,0.0002957454,0.0009130543,0.0047263433,0.0010669923],"domain_scores_gemma":[0.9835872,0.0026275378,0.0010063491,0.0024061324,0.009381157,0.0009916053],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005077076,0.0005124256,0.0005949807,0.031127144,0.010400635,0.007858695,0.0021592982,0.000698077,0.019279908],"category_scores_gemma":[0.02124201,0.0005188895,0.00049144094,0.05680427,0.0038523304,0.0021390438,0.0047070496,0.0018207566,0.0013546131],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026636512,0.000043979406,0.02684791,0.0013577187,0.000082022634,0.0005867568,0.058957953,0.0023189867,0.0022268358,0.14665277,0.24651417,0.5141445],"study_design_scores_gemma":[0.000007339689,0.0000059872127,0.052778795,0.00045452805,0.00003688919,0.00011328415,0.0059931087,0.00030535046,0.0011743817,0.0018488085,0.937219,0.000062516185],"about_ca_topic_score_codex":0.9830294,"about_ca_topic_score_gemma":0.99072194,"teacher_disagreement_score":0.10101984,"about_ca_system_score_codex":0.10101984,"about_ca_system_score_gemma":0.12042308,"threshold_uncertainty_score":0.73295367},"labels":[],"label_agreement":null},{"id":"W2593276484","doi":"10.22148/16.016","title":"Topic Modeling the Hàn diăn Ancient Classics","year":2017,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Pinyin; Topic model; Pronunciation; Linguistics; Computer science; History; Natural language processing; Artificial intelligence; Chinese characters; Philosophy","score_opus":0.1623321213294615,"score_gpt":0.43606651150148973,"score_spread":0.2737343901720282,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2593276484","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.39035815,0.0076698908,0.5675967,0.0046233,0.0003300357,0.00028311435,0.0052449466,0.0010748152,0.022819024],"genre_scores_gemma":[0.9041876,0.002217297,0.076171994,0.00019364919,0.00032116935,0.0002799815,0.003335346,0.00017868406,0.013114187],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991375,0.0003685257,0.00004611554,0.00026525315,0.00011529122,0.00006722633],"domain_scores_gemma":[0.9971578,0.002221192,0.000117861986,0.00019961104,0.00022092696,0.00008249606],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002198717,0.00050156756,0.00056854147,0.002024701,0.000871254,0.002608806,0.00093626947,0.0005965232,0.003063044],"category_scores_gemma":[0.0078103472,0.00033813735,0.0008773295,0.0028063287,0.0007840871,0.002148851,0.0008891819,0.0008942761,0.0006116273],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00059504324,0.00022779545,0.0457805,0.0008948742,0.0005444603,0.0010582103,0.012397959,0.19710341,0.0035905247,0.33058664,0.03227026,0.37495035],"study_design_scores_gemma":[0.000038875045,0.000039804607,0.014709236,0.00010079113,0.00011089351,0.00030530535,0.0015448716,0.8425754,0.0013404934,0.1004448,0.03873299,0.0000565524],"about_ca_topic_score_codex":0.013865201,"about_ca_topic_score_gemma":0.012285068,"teacher_disagreement_score":0.013865201,"about_ca_system_score_codex":0.0013327014,"about_ca_system_score_gemma":0.0010440025,"threshold_uncertainty_score":0.027568996},"labels":[],"label_agreement":null},{"id":"W2593732251","doi":"10.1017/s0922156517000085","title":"Can Quantitative Methods Complement Doctrinal Legal Studies? Using Citation Network and Corpus Linguistic Analysis to Understand International Courts","year":2017,"lang":"en","type":"article","venue":"Leiden Journal of International Law","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":130,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for International Governance Innovation","funders":"","keywords":"Legal translation; Political science; Empirical legal studies; Law; Jurisprudence; Sources of law; International law; Comparative law; Human rights; Legal culture; Sociology","score_opus":0.23170169346681393,"score_gpt":0.5415538491311146,"score_spread":0.3098521556643007,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2593732251","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10346508,0.04543164,0.71624094,0.05136638,0.0035732177,0.000601507,0.0034298033,0.0009979679,0.074893475],"genre_scores_gemma":[0.7539317,0.012721407,0.22316171,0.0019366305,0.002417805,0.0011118773,0.0013231728,0.0002855382,0.0031101163],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9662234,0.026377322,0.0018968595,0.0015691662,0.0036528457,0.00028039582],"domain_scores_gemma":[0.7638956,0.20766075,0.009454955,0.009277418,0.008983223,0.00072803913],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.034483064,0.00081243203,0.0011772958,0.029733628,0.0016343007,0.012084224,0.001752471,0.0019457196,0.0058255414],"category_scores_gemma":[0.15033619,0.00036205712,0.0005908354,0.028923174,0.006288969,0.018438004,0.0032504345,0.001969954,0.000623862],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007382964,0.00014701312,0.015113839,0.0028737308,0.0005153807,0.00016679085,0.011764948,0.0040500467,0.000732575,0.72299534,0.0137996385,0.22776678],"study_design_scores_gemma":[0.000028051129,0.00004790361,0.0126935635,0.0021229202,0.00012016052,0.00013354346,0.009037684,0.037095286,0.00079680147,0.86511755,0.072707005,0.00009959225],"about_ca_topic_score_codex":0.0022690583,"about_ca_topic_score_gemma":0.0028990253,"teacher_disagreement_score":0.97026634,"about_ca_system_score_codex":0.0026880351,"about_ca_system_score_gemma":0.0022325253,"threshold_uncertainty_score":0.18236601},"labels":[],"label_agreement":null},{"id":"W2612748823","doi":"10.1002/rwm3.20527","title":"How researchers used analytics to crack the cultural code","year":2017,"lang":"en","type":"article","venue":"Research World","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Analytics; Data science; Code (set theory); Computer science; Business; Programming language","score_opus":0.6669966525565016,"score_gpt":0.6223391490598674,"score_spread":0.04465750349663422,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2612748823","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6483934,0.0028213135,0.049268853,0.07587116,0.001164679,0.0015894107,0.0012317821,0.0005978114,0.21906169],"genre_scores_gemma":[0.9579741,0.0010049419,0.01651203,0.0034097158,0.000060774055,0.00038749597,0.00028750993,0.00040361797,0.019959942],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.9317508,0.046086892,0.0015775064,0.0033387023,0.010678509,0.006567753],"domain_scores_gemma":[0.8137744,0.12674463,0.0047606663,0.01183517,0.037772167,0.005112959],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06560143,0.0009321171,0.0007532796,0.012213394,0.03218966,0.02835489,0.0038931652,0.004168712,0.0039171823],"category_scores_gemma":[0.16692197,0.00075290824,0.0007949626,0.015441623,0.024541447,0.014691377,0.0077280896,0.0050277724,0.00054211466],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006369098,0.00006637801,0.0131115215,0.00021242964,0.000034501143,0.00065678416,0.83540463,0.00046003083,0.00073948636,0.10085868,0.010996791,0.03739511],"study_design_scores_gemma":[0.0000226906,0.00002954325,0.0055322144,0.00066306087,0.000045680652,0.00017010518,0.8440558,0.0014293938,0.0014684984,0.020340402,0.12613228,0.00011040353],"about_ca_topic_score_codex":0.8635745,"about_ca_topic_score_gemma":0.8752621,"teacher_disagreement_score":0.8635745,"about_ca_system_score_codex":0.06976521,"about_ca_system_score_gemma":0.11569114,"threshold_uncertainty_score":0.5061844},"labels":[],"label_agreement":null},{"id":"W2626239136","doi":"","title":"Old people, Video Games and Newspapers : A topic-model approach on a study about deviance, entertainment and self-development","year":2016,"lang":"en","type":"preprint","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Deviance (statistics); Newspaper; Entertainment; Computer science; Multimedia; Advertising; Media studies; Sociology; Machine learning; Art; Visual arts","score_opus":0.019042650847912027,"score_gpt":0.28040522789379363,"score_spread":0.2613625770458816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2626239136","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97861505,0.0012312408,0.014097686,0.0011047149,0.000032263044,0.00018535389,0.00040755654,0.000023844426,0.0043021375],"genre_scores_gemma":[0.991702,0.0006936475,0.004991265,0.00009056645,0.000051241343,0.00024528007,0.00035997268,0.000024940977,0.0018411538],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9979668,0.0015463164,0.000069072696,0.00019752656,0.000121178964,0.00009891942],"domain_scores_gemma":[0.9615534,0.036351334,0.0006857361,0.0004024265,0.00036703865,0.00064017624],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0052424856,0.00061803096,0.00090077065,0.0030944748,0.0017608982,0.0045765657,0.0012367541,0.0017636124,0.0041531916],"category_scores_gemma":[0.012069496,0.00048806038,0.0014573137,0.0045416662,0.0018410129,0.0039172154,0.0017910532,0.0015029975,0.00023122958],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021156122,0.0037391433,0.4486149,0.0014398487,0.0013077167,0.0022843403,0.30545643,0.018414566,0.0039645866,0.107301876,0.0037852456,0.101575665],"study_design_scores_gemma":[0.0005403768,0.0014047526,0.44752508,0.0006059008,0.0019633009,0.001013094,0.23373678,0.2060899,0.001553113,0.0888254,0.016513212,0.00022912482],"about_ca_topic_score_codex":0.026082521,"about_ca_topic_score_gemma":0.027786849,"teacher_disagreement_score":0.026082521,"about_ca_system_score_codex":0.0021292078,"about_ca_system_score_gemma":0.0012208354,"threshold_uncertainty_score":0.051861405},"labels":[],"label_agreement":null},{"id":"W2676933691","doi":"10.1007/s10459-009-9174-2","title":"Erratum to: Is case-specificity content-specificity? An analysis of data from extended-matching questions","year":2009,"lang":"en","type":"erratum","venue":"Advances in Health Sciences Education","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Matching (statistics); Content (measure theory); Content analysis; Computer science; Computational biology; Natural language processing; Information retrieval; Medicine; Biology; Pathology; Mathematics; Sociology; Social science","score_opus":0.13911593263885513,"score_gpt":0.4938656111506286,"score_spread":0.35474967851177347,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2676933691","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031708885,0.0028385776,0.018225785,0.42215687,0.42034855,0.0007907816,0.041624278,0.0018013808,0.0605049],"genre_scores_gemma":[0.22841443,0.00571662,0.06045238,0.23296277,0.03751385,0.002147001,0.045796376,0.0052552638,0.38174134],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99346715,0.0019758232,0.0014674783,0.00071926776,0.0021380058,0.00023224128],"domain_scores_gemma":[0.8289127,0.12571676,0.005798105,0.0069150333,0.03146787,0.0011895129],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010104175,0.0008003009,0.0010040313,0.0026465368,0.0030522775,0.0020078411,0.0014789242,0.0023047645,0.05613654],"category_scores_gemma":[0.19979064,0.00056525547,0.00064635294,0.0031427015,0.0018644335,0.0022824057,0.0017284004,0.0039080665,0.012256072],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016169935,0.00003646724,0.0018456023,0.00019677676,0.000015410691,0.00033850144,0.00050865224,0.00009376925,0.000101026795,0.0043150745,0.978574,0.013813073],"study_design_scores_gemma":[0.0002040482,0.00013727671,0.020679848,0.0010303427,0.00018042189,0.0024024511,0.0038890028,0.0014875967,0.0019192161,0.01606403,0.95186,0.00014573548],"about_ca_topic_score_codex":0.013351379,"about_ca_topic_score_gemma":0.01901458,"teacher_disagreement_score":0.05613654,"about_ca_system_score_codex":0.0025953897,"about_ca_system_score_gemma":0.004887314,"threshold_uncertainty_score":0.18779546},"labels":[],"label_agreement":null},{"id":"W2747223115","doi":"10.21514/1998-426x-2017-10-2-23-30","title":"Analysis of the media coverage characteristics on radiation safety issues of the Saint-Petersburg and the Leningrad region population","year":2017,"lang":"en","type":"article","venue":"Radiacionnaâ gigiena","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Newspaper; Saint petersburg; Population; Quarter (Canadian coin); Qualitative analysis; Geography; Mass media; Library science; Advertising; Russian federation; Computer science; Qualitative research; Business; Regional science; Sociology; Demography; Archaeology; Social science","score_opus":0.02565802490488131,"score_gpt":0.32620659341002595,"score_spread":0.30054856850514466,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2747223115","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9931068,0.00058484427,0.00008755856,0.00013785894,0.000013196025,0.000022613414,0.0019392582,0.000011208382,0.0040968014],"genre_scores_gemma":[0.99604946,0.0008953849,0.00012431074,0.000026314867,0.00004857913,0.000032187883,0.0016007794,0.000010620492,0.0012123629],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9990637,0.00021929159,0.00014999908,0.00012760778,0.00032324126,0.000116294395],"domain_scores_gemma":[0.992812,0.002670009,0.002885637,0.0002576415,0.0010602189,0.00031454331],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001126992,0.00022894893,0.00024753597,0.008087175,0.00032007543,0.0017412049,0.00030206892,0.00020048449,0.0035852117],"category_scores_gemma":[0.005932835,0.00014244055,0.00030207005,0.005842694,0.00033184886,0.00092873164,0.00081970985,0.00024295218,0.00064640807],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010346531,0.000047620353,0.96886104,0.00018732718,0.00011128614,0.0004632662,0.0055800476,0.00011855741,0.0007953395,0.00026045035,0.0010421224,0.02242943],"study_design_scores_gemma":[0.0000015485676,0.000027986183,0.9913094,0.000048135356,0.000030594794,0.0002764472,0.0051725935,0.00009938793,0.0002846647,0.000024555162,0.0027187737,0.0000059251183],"about_ca_topic_score_codex":0.0063531892,"about_ca_topic_score_gemma":0.0041456865,"teacher_disagreement_score":0.008087175,"about_ca_system_score_codex":0.00049855467,"about_ca_system_score_gemma":0.0005727065,"threshold_uncertainty_score":0.01263243},"labels":[],"label_agreement":null},{"id":"W2751763719","doi":"","title":"K-means and Hierarchical Clustering Method to Improve our Understanding of Citation Contexts","year":2017,"lang":"en","type":"preprint","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Cluster analysis; Citation; Computer science; Hierarchical clustering; Focus (optics); Set (abstract data type); Information retrieval; Data science; Phenomenon; Section (typography); World Wide Web; Artificial intelligence; Epistemology; Physics","score_opus":0.06243913043965525,"score_gpt":0.3615403434242099,"score_spread":0.2991012129845546,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2751763719","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045472417,0.0031689934,0.9336958,0.001475312,0.0006238002,0.00026033627,0.0030190593,0.0033500714,0.008934154],"genre_scores_gemma":[0.3370814,0.0014441833,0.6454869,0.00032196855,0.00056014,0.00047205863,0.0033702184,0.0010380473,0.010225037],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9974993,0.00089709024,0.00023027847,0.0006075648,0.0006031849,0.0001624663],"domain_scores_gemma":[0.9900209,0.0047385474,0.0005738399,0.0015326525,0.0027942038,0.00033990882],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0024740244,0.00079374656,0.0012277641,0.010241843,0.0029017145,0.0034229464,0.001701448,0.0017498628,0.008523],"category_scores_gemma":[0.022434944,0.00043853858,0.0017460556,0.012940935,0.0008486539,0.0038702956,0.0017638718,0.0019043393,0.0036023292],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029025303,0.00033558346,0.01452566,0.001128317,0.0006642174,0.00041235355,0.0035106249,0.045204207,0.013302383,0.15368462,0.054477274,0.71246445],"study_design_scores_gemma":[0.00006130895,0.000073463896,0.014469294,0.0002440179,0.0003973148,0.00045541118,0.0015555547,0.59203047,0.009169857,0.3268188,0.05449386,0.00023070718],"about_ca_topic_score_codex":0.015339752,"about_ca_topic_score_gemma":0.024329716,"teacher_disagreement_score":0.98975813,"about_ca_system_score_codex":0.0015720444,"about_ca_system_score_gemma":0.0034274727,"threshold_uncertainty_score":0.030500948},"labels":[],"label_agreement":null},{"id":"W2767239194","doi":"10.1558/jch.31662","title":"Mining the Past – Data-Intensive Knowledge Discovery in the Study of Historical Textual Traditions","year":2018,"lang":"en","type":"article","venue":"Journal of Cognitive Historiography","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Digitization; Data science; Praise; Computer science; Field (mathematics); Reading (process); Comparative historical research; Big data; Scope (computer science); Sociology; Data mining; Social science; Political science; Psychology","score_opus":0.12470086766177105,"score_gpt":0.3935506063984692,"score_spread":0.26884973873669815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2767239194","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059928786,0.0042342874,0.91937315,0.010156559,0.000120436605,0.0003820919,0.0010334107,0.0004518792,0.004319407],"genre_scores_gemma":[0.26244122,0.0029096873,0.7296272,0.0006167408,0.00028581763,0.00056449213,0.0012063505,0.0001125842,0.0022358494],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9923078,0.0047627017,0.00056375895,0.0011330359,0.0010716289,0.00016101274],"domain_scores_gemma":[0.9349718,0.055801354,0.0024698556,0.0043676235,0.0016924709,0.0006968648],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013903085,0.00068510306,0.0010913918,0.009476112,0.002060998,0.0066181975,0.0036564749,0.0020857013,0.0016401215],"category_scores_gemma":[0.041989896,0.0008308578,0.001709775,0.008170858,0.0047662277,0.011944125,0.0038903719,0.0023333991,0.0005721552],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018607875,0.0006328508,0.032415394,0.0019275578,0.00046360955,0.0008660603,0.014459773,0.04784452,0.002504122,0.46912017,0.009642643,0.4199372],"study_design_scores_gemma":[0.000028979124,0.00005113171,0.003587082,0.00041125724,0.00007110813,0.00030199433,0.0028429055,0.2459813,0.002149476,0.7218283,0.022676323,0.00007018732],"about_ca_topic_score_codex":0.0050968626,"about_ca_topic_score_gemma":0.008244184,"teacher_disagreement_score":0.013903085,"about_ca_system_score_codex":0.0020615808,"about_ca_system_score_gemma":0.0039626975,"threshold_uncertainty_score":0.073527396},"labels":[],"label_agreement":null},{"id":"W2767651718","doi":"10.1007/s11135-017-0650-0","title":"Supervised scaling of semi-structured interview transcripts to characterize the ideology of a social policy reform","year":2017,"lang":"en","type":"article","venue":"Quality & Quantity","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"Fonds de Recherche du Québec-Société et Culture","keywords":"Ideology; Content analysis; Scope (computer science); Qualitative research; Multidimensional scaling; Scaling; Content (measure theory); Sociology; Computer science; Politics; Data science; Political science; Social science; Machine learning; Law; Mathematics","score_opus":0.21672034890292985,"score_gpt":0.4793613689200769,"score_spread":0.26264102001714706,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2767651718","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6398702,0.00033970526,0.30931824,0.00094037014,0.00045399708,0.0058506443,0.02380804,0.0017650346,0.017653717],"genre_scores_gemma":[0.7935143,0.00014581047,0.1681226,0.0001946803,0.00016301197,0.012197522,0.020972302,0.00036060365,0.004329227],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9895923,0.0066807414,0.0007657097,0.0014686057,0.0012033863,0.00028913707],"domain_scores_gemma":[0.929542,0.048775196,0.0056032115,0.004790437,0.0106828315,0.0006062788],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00818676,0.00056216604,0.0004787219,0.0027627228,0.0011855,0.0014110941,0.00083106797,0.0006184036,0.005059103],"category_scores_gemma":[0.054981302,0.00023751025,0.00046746508,0.002833113,0.0010506195,0.00086748076,0.002048589,0.0010916335,0.0019421921],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027071314,0.0010640951,0.11193927,0.0038132102,0.0004208756,0.0007272217,0.1013342,0.013099261,0.14943205,0.023419306,0.04817282,0.5438706],"study_design_scores_gemma":[0.00047202248,0.0009975767,0.42997986,0.0010779003,0.00037238825,0.0007210007,0.0718306,0.2389701,0.07608705,0.053944126,0.12509827,0.0004491254],"about_ca_topic_score_codex":0.0023113054,"about_ca_topic_score_gemma":0.0065887854,"teacher_disagreement_score":0.00818676,"about_ca_system_score_codex":0.0012355879,"about_ca_system_score_gemma":0.0022161894,"threshold_uncertainty_score":0.043296218},"labels":[],"label_agreement":null},{"id":"W2784791047","doi":"10.16995/dscn.295","title":"Is Falstaff Falstaff? Is Prince Hal Henry V?: Topic Modeling Shakespeare’s Plays","year":2018,"lang":"en","type":"article","venue":"Digital Studies / Le champ numérique","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Diction; Henry IV, Holy Roman Emperor; Comedy; Assertion; Literature; Windsor; Art; Humanities; Philosophy; History; Art history; Performance art; Computer science; Poetry","score_opus":0.08250917444305281,"score_gpt":0.3724178941232322,"score_spread":0.2899087196801794,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2784791047","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.49578026,0.0059113563,0.4219801,0.018976726,0.0003941797,0.00019743759,0.00265453,0.0007640133,0.05334134],"genre_scores_gemma":[0.93737215,0.0013387724,0.05415197,0.00033373354,0.00020397689,0.00012932958,0.0013106982,0.00017647173,0.0049829762],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99799335,0.0013151322,0.000071340495,0.0003226945,0.0002079893,0.000089507485],"domain_scores_gemma":[0.99182314,0.0070849685,0.00031466337,0.00035987332,0.00027748744,0.00013987719],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003937911,0.00046054178,0.0004067687,0.0021583778,0.0013504145,0.0065531735,0.0009176469,0.0009524217,0.0019008965],"category_scores_gemma":[0.011139333,0.00033133957,0.00063240953,0.0024017012,0.0023631305,0.0056651356,0.0012435718,0.0015603334,0.0006098816],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032041816,0.0002174512,0.07005175,0.00048446565,0.00022911986,0.0008189915,0.11561009,0.04541129,0.0032004723,0.5421463,0.019327391,0.20218225],"study_design_scores_gemma":[0.000040929423,0.00007103693,0.026146632,0.00047980872,0.00011542391,0.00058959826,0.065129556,0.46098801,0.0033320927,0.3011919,0.14177634,0.00013877935],"about_ca_topic_score_codex":0.01727563,"about_ca_topic_score_gemma":0.01822094,"teacher_disagreement_score":0.01727563,"about_ca_system_score_codex":0.0025202157,"about_ca_system_score_gemma":0.0012813275,"threshold_uncertainty_score":0.034350157},"labels":[],"label_agreement":null},{"id":"W2788605280","doi":"10.63317/37krdg6qf9fs","title":"‘Aye’ or ‘No’? Speech-level Sentiment Analysis of Hansard UK Parliamentary Debate Transcripts","year":2018,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Open Text (Canada)","funders":"","keywords":"Sentiment analysis; Speech recognition; Computer science; Political science; Natural language processing","score_opus":0.10286469033798028,"score_gpt":0.3909686534896928,"score_spread":0.2881039631517125,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2788605280","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98419833,0.00018865857,0.0056701545,0.00037792308,0.00009747879,0.00012875204,0.004088611,0.00014313677,0.005106881],"genre_scores_gemma":[0.98275006,0.000103280276,0.0066282027,0.000047681748,0.00005602755,0.00015264678,0.0061049317,0.0000444236,0.004112816],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99793756,0.001023095,0.00015827632,0.00021180479,0.0005159656,0.00015339613],"domain_scores_gemma":[0.99089265,0.006765415,0.0007563072,0.00026285864,0.0011469473,0.00017569911],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015885276,0.0002711311,0.00026886887,0.0011852798,0.00058803987,0.0008821121,0.0002692701,0.00057933806,0.0023386222],"category_scores_gemma":[0.011159016,0.000121328005,0.00023655516,0.0011538733,0.00053542294,0.00039798763,0.00068106235,0.0005624643,0.0014560575],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0052764444,0.0004810185,0.13092624,0.0027975293,0.0002344933,0.00448738,0.0822584,0.014836416,0.21665576,0.009249931,0.045952782,0.4868437],"study_design_scores_gemma":[0.00017014504,0.00091605564,0.5593746,0.0006260065,0.00014328878,0.0021861196,0.046675604,0.14901417,0.12590246,0.0060945605,0.10859867,0.00029828964],"about_ca_topic_score_codex":0.004084945,"about_ca_topic_score_gemma":0.008168837,"teacher_disagreement_score":0.004084945,"about_ca_system_score_codex":0.0006902806,"about_ca_system_score_gemma":0.00032082148,"threshold_uncertainty_score":0.008401036},"labels":[],"label_agreement":null},{"id":"W2788895881","doi":"10.1016/b978-1-84334-749-1.00009-3","title":"User-Driven Text Mining of Historical Text","year":2016,"lang":"en","type":"book-chapter","venue":"Elsevier eBooks","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of St Andrews; York University","keywords":"Digging; Computer science; Empire; Commodity; Data science; World Wide Web; History; Archaeology; Business","score_opus":0.04120177409934209,"score_gpt":0.3172274322881648,"score_spread":0.27602565818882274,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2788895881","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051913276,0.003425462,0.89994085,0.00122935,0.0005818802,0.00063548953,0.013514833,0.015464302,0.013294504],"genre_scores_gemma":[0.17848077,0.0021634141,0.7667608,0.00027886167,0.0005565483,0.0006480112,0.028573042,0.0012332536,0.02130529],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980263,0.0006412486,0.00019019318,0.0004672645,0.00060808845,0.00006686157],"domain_scores_gemma":[0.99311334,0.0048713274,0.00026094797,0.000625297,0.0009885911,0.00014050477],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023680392,0.0009302935,0.0007644799,0.0053938637,0.0007501074,0.002471545,0.0014321308,0.0008908372,0.00828096],"category_scores_gemma":[0.010350236,0.0003943299,0.000980034,0.004640099,0.0004461941,0.0029299296,0.0014389497,0.0009217788,0.007991544],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019437354,0.00014829653,0.0038303453,0.000894558,0.00011316244,0.0003356415,0.00075650314,0.0047191307,0.021232747,0.0048645437,0.03567487,0.92723596],"study_design_scores_gemma":[0.00005704671,0.00030907025,0.015310978,0.00060849305,0.00025289532,0.0025571722,0.0017662677,0.62913066,0.09176084,0.054787245,0.20328595,0.00017340099],"about_ca_topic_score_codex":0.0013093151,"about_ca_topic_score_gemma":0.0031470128,"teacher_disagreement_score":0.00828096,"about_ca_system_score_codex":0.0004020994,"about_ca_system_score_gemma":0.00090176676,"threshold_uncertainty_score":0.02770257},"labels":[],"label_agreement":null},{"id":"W2791572729","doi":"10.1073/pnas.1719792115","title":"Measuring discursive influence across scholarship","year":2018,"lang":"en","type":"article","venue":"Proceedings of the National Academy of Sciences","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":54,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Air Force Office of Scientific Research; Killam Trusts; John Templeton Foundation; National Science Foundation","keywords":"Scholarship; TRACE (psycholinguistics); Citation; Sociology; Data science; Measure (data warehouse); Epistemology; Social science; Computer science; Political science; Library science; Linguistics; Data mining","score_opus":0.14609545634813623,"score_gpt":0.4331857178187166,"score_spread":0.28709026147058037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2791572729","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96091455,0.0019932066,0.0155652985,0.00061700016,0.000055952278,0.0002604221,0.0017661982,0.0001552753,0.018672122],"genre_scores_gemma":[0.9905749,0.00047733544,0.005802898,0.00006927154,0.00018254711,0.00028757306,0.0010980238,0.00005949581,0.001447927],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9863179,0.0038035149,0.0014842908,0.0022909676,0.005520363,0.00058294757],"domain_scores_gemma":[0.88199383,0.07303789,0.021253789,0.008249162,0.012400417,0.0030648957],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.014583545,0.00049440196,0.001065327,0.021609196,0.0021342672,0.0060205963,0.0012443952,0.0011766596,0.0021541682],"category_scores_gemma":[0.12146452,0.0003845189,0.0007508687,0.023987692,0.0023379214,0.0068325405,0.004459736,0.0010638746,0.0007849063],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024586372,0.00034554364,0.81813824,0.0006544677,0.0007210689,0.00021311197,0.022059916,0.0053620227,0.0049719173,0.016266217,0.0019644604,0.12905714],"study_design_scores_gemma":[0.00003456865,0.00037503292,0.93096775,0.00015367895,0.00030966118,0.00026997668,0.0061838166,0.01309822,0.005407016,0.026862152,0.016225666,0.00011246846],"about_ca_topic_score_codex":0.0041481005,"about_ca_topic_score_gemma":0.005060721,"teacher_disagreement_score":0.9783908,"about_ca_system_score_codex":0.002337619,"about_ca_system_score_gemma":0.0017242844,"threshold_uncertainty_score":0.077126086},"labels":[],"label_agreement":null},{"id":"W2800743636","doi":"10.2139/ssrn.3067734","title":"The R Package sentometrics to Compute, Aggregate and Predict with Textual Sentiment","year":2017,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":25,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke; Center for Interuniversity Research and Analysis on Organizations; HEC Montréal","funders":"","keywords":"Indexation; Computer science; Sentiment analysis; Aggregate (composite); R package; Workflow; Index (typography); Information retrieval; Natural language processing; Database; World Wide Web; Programming language; Economics; Monetary policy","score_opus":0.017441463959064988,"score_gpt":0.33473910715896305,"score_spread":0.31729764319989806,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2800743636","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020425824,0.00080614036,0.42767543,0.0011890226,0.0009845167,0.0006371311,0.16705905,0.3633435,0.01787943],"genre_scores_gemma":[0.116272405,0.0009508677,0.5937206,0.0008399261,0.0006456923,0.004023226,0.115878835,0.13015844,0.037510026],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99825937,0.00065270904,0.00016709311,0.0003822597,0.0003997426,0.00013885094],"domain_scores_gemma":[0.99321836,0.0037190279,0.00070841407,0.001404353,0.00076853187,0.00018128888],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024604579,0.002330006,0.0013232286,0.0043310826,0.00065785204,0.0029288004,0.0011003504,0.0006575393,0.05071777],"category_scores_gemma":[0.031429913,0.00087887153,0.002298909,0.0033041397,0.00060961774,0.0017997493,0.002402844,0.0014412174,0.058577124],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005598637,0.00018290407,0.017640864,0.0022081137,0.0016549105,0.00039987278,0.00084085576,0.011512153,0.005129963,0.029487457,0.6797498,0.25063327],"study_design_scores_gemma":[0.0005437144,0.00031235174,0.019736607,0.00040440747,0.0009470693,0.0011708243,0.00042342173,0.17662573,0.017632447,0.10973009,0.67218095,0.00029235875],"about_ca_topic_score_codex":0.002717016,"about_ca_topic_score_gemma":0.005643324,"teacher_disagreement_score":0.05071777,"about_ca_system_score_codex":0.000650597,"about_ca_system_score_gemma":0.002195629,"threshold_uncertainty_score":0.16966784},"labels":[],"label_agreement":null},{"id":"W2810369529","doi":"10.1017/s1049096518000926","title":"Data Access, Transparency, and Replication: New Insights from the Political Behavior Literature","year":2018,"lang":"en","type":"article","venue":"PS Political Science & Politics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Transparency (behavior); Politics; Replication (statistics); Political science; Data sharing; Public relations; Law; Statistics; Medicine; Mathematics","score_opus":0.1624169664032016,"score_gpt":0.47774986366354033,"score_spread":0.31533289726033875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2810369529","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23653,0.03296794,0.51095617,0.16534431,0.0022140557,0.0019094929,0.003309848,0.0004902197,0.046277992],"genre_scores_gemma":[0.9374876,0.0025958735,0.05312662,0.0031028625,0.0013277025,0.0010357251,0.000515434,0.00015142484,0.0006568356],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.39145675,0.49781057,0.03183162,0.025969794,0.04852914,0.004402121],"domain_scores_gemma":[0.027879702,0.88115,0.030363344,0.046018045,0.013691892,0.0008970532],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4539078,0.0012437429,0.0027323752,0.016671183,0.0067759515,0.019975707,0.0065663736,0.0063565737,0.007763606],"category_scores_gemma":[0.8401303,0.0018861226,0.0031808866,0.02611863,0.03322706,0.03989817,0.011511963,0.008426318,0.0007067611],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011210165,0.00047492428,0.1478918,0.0074173254,0.0023448323,0.0036780036,0.1335853,0.0052252193,0.0011321007,0.48010078,0.015226447,0.20180227],"study_design_scores_gemma":[0.0002221815,0.000218539,0.029447166,0.0048120464,0.0010691922,0.0016487666,0.03155587,0.02960508,0.0016410461,0.8664362,0.03303528,0.00030866664],"about_ca_topic_score_codex":0.005947894,"about_ca_topic_score_gemma":0.0047922553,"teacher_disagreement_score":0.9833288,"about_ca_system_score_codex":0.0062878756,"about_ca_system_score_gemma":0.012049175,"threshold_uncertainty_score":0.67342895},"labels":[],"label_agreement":null},{"id":"W2873346580","doi":"10.24908/iqurcp.11597","title":"A Finding Aid for The Equity","year":2018,"lang":"en","type":"article","venue":"Inquiry Queen s Undergraduate Research Conference Proceedings","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Newspaper; Search engine indexing; Computer science; World Wide Web; Optical character recognition; Information retrieval; Index (typography); Equity (law); Rendering (computer graphics); Artificial intelligence; Advertising; Political science; Business","score_opus":0.38893448074606457,"score_gpt":0.5406121727797221,"score_spread":0.1516776920336575,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2873346580","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01645664,0.004511207,0.080438875,0.04419929,0.007412231,0.0018573535,0.036653668,0.058385078,0.7500857],"genre_scores_gemma":[0.06315936,0.003006407,0.190204,0.0059277285,0.0012797595,0.00059191056,0.021127384,0.005182512,0.70952094],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99565244,0.00062577595,0.0003117046,0.00070324144,0.0022452448,0.00046150634],"domain_scores_gemma":[0.98422134,0.0037833129,0.00055628305,0.0023517574,0.007751428,0.0013359148],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0049907467,0.001073223,0.00089881505,0.009575001,0.005547352,0.008480892,0.003283117,0.002148068,0.16625029],"category_scores_gemma":[0.02431299,0.0005864688,0.000671834,0.009129169,0.0020628711,0.0071020317,0.0061642053,0.0014571415,0.04154564],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013055952,0.00005483366,0.00187999,0.00027073675,0.000010236673,0.000455726,0.0017388061,0.00024143176,0.0007478494,0.026338374,0.6823809,0.28575057],"study_design_scores_gemma":[0.00002585252,0.0000144153,0.0004419946,0.000105560845,0.000011284623,0.00014361093,0.00086048193,0.00049031375,0.0005088425,0.002953491,0.99442357,0.000020421014],"about_ca_topic_score_codex":0.30404666,"about_ca_topic_score_gemma":0.35737795,"teacher_disagreement_score":0.30404666,"about_ca_system_score_codex":0.010997207,"about_ca_system_score_gemma":0.021772223,"threshold_uncertainty_score":0.6045538},"labels":[],"label_agreement":null},{"id":"W2885524379","doi":"10.1386/jgvw.10.2.135_1","title":"‘Very much like any other Japanese RPG you’ve ever played’: Using undirected topic modelling to examine the evolution of JRPGs’ presence in anglophone web publications","year":2018,"lang":"en","type":"article","venue":"Journal of Gaming & Virtual Worlds","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Sociology; Extension (predicate logic); Media studies; Computer science","score_opus":0.05397776870589618,"score_gpt":0.3467548342844287,"score_spread":0.29277706557853256,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2885524379","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.983293,0.0007526359,0.0078034964,0.0005071378,0.000026909482,0.000046444628,0.0005030795,0.000030082974,0.007037159],"genre_scores_gemma":[0.9954449,0.00027916045,0.0030284396,0.000039465012,0.00002993822,0.00004417183,0.0003582591,0.000022414673,0.00075334165],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973367,0.0015695057,0.0001620088,0.00045065768,0.0003403477,0.00014067502],"domain_scores_gemma":[0.9691612,0.024708983,0.0034850624,0.00062332343,0.001523718,0.000497694],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047090785,0.00027173563,0.00031385303,0.004414919,0.0012002324,0.0044354517,0.00044400795,0.00040441594,0.0011133718],"category_scores_gemma":[0.019964565,0.00022843567,0.0003572098,0.00530229,0.0018606677,0.0036718284,0.0015182088,0.00081342086,0.0003514828],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047395192,0.000107118896,0.46159497,0.00089592143,0.00018709147,0.0015012355,0.4041542,0.0022593306,0.0065693636,0.01892143,0.002174429,0.10116086],"study_design_scores_gemma":[0.000019871359,0.00017301268,0.63371146,0.00055244437,0.0002466117,0.0010291453,0.2640908,0.041147456,0.003248212,0.0095431935,0.046100773,0.00013694524],"about_ca_topic_score_codex":0.010932516,"about_ca_topic_score_gemma":0.017711874,"teacher_disagreement_score":0.010932516,"about_ca_system_score_codex":0.0013661569,"about_ca_system_score_gemma":0.0009767254,"threshold_uncertainty_score":0.02490431},"labels":[],"label_agreement":null},{"id":"W2886358838","doi":"10.18653/v1/w16-56","title":"Proceedings of the First Workshop on NLP and Computational Social Science","year":2016,"lang":"en","type":"paratext","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Pacific Northwest National Laboratory; Office of Naval Research; University of Toronto; University of California, San Diego; Defense Advanced Research Projects Agency; Universiteit van Tilburg; University of Massachusetts Amherst; Freie Universität Berlin; Centre National de la Recherche Scientifique; University of Melbourne; Institute for Quantitative Social Science, Harvard University; University of Pittsburgh; Korea Advanced Institute of Science and Technology; University of Minnesota; National Science Foundation; Princeton University; University of Washington; Harvard Business School; Ohio State University; University of Pennsylvania; Multidisciplinary University Research Initiative; McGill University; Microsoft Research; University College London; Carnegie Mellon University","keywords":"Computer science; Artificial intelligence; Natural language processing; Data science","score_opus":0.04071723295587542,"score_gpt":0.37391744525026044,"score_spread":0.333200212294385,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2886358838","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010410443,0.017774234,0.52792937,0.16842191,0.05334179,0.0009978532,0.018259343,0.0060029654,0.19686219],"genre_scores_gemma":[0.069720104,0.019930936,0.30549133,0.014427745,0.015908567,0.0025010344,0.051088627,0.009120409,0.5118112],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9903894,0.0061114123,0.0005280013,0.0010052462,0.0016341836,0.0003317586],"domain_scores_gemma":[0.9594934,0.025416132,0.0004489645,0.0051871026,0.0055047222,0.0039497465],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021996826,0.0012046702,0.0014839711,0.003436028,0.002884985,0.011714271,0.0025659988,0.0027651398,0.059110176],"category_scores_gemma":[0.043603282,0.00060760084,0.0021172815,0.0038990595,0.0034074958,0.014769031,0.009023434,0.008818437,0.01965215],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019379982,0.00015572237,0.00054973847,0.00060415285,0.000071661365,0.00022324247,0.0015926587,0.0027562287,0.0009933235,0.09751593,0.7138554,0.18148816],"study_design_scores_gemma":[0.000026021386,0.000021177784,0.00041453238,0.00027641212,0.000017695562,0.000115660034,0.00049484073,0.0052552717,0.001085262,0.07591972,0.9163435,0.00002987891],"about_ca_topic_score_codex":0.0064738602,"about_ca_topic_score_gemma":0.010380166,"teacher_disagreement_score":0.059110176,"about_ca_system_score_codex":0.0043450915,"about_ca_system_score_gemma":0.009424166,"threshold_uncertainty_score":0.19774324},"labels":[],"label_agreement":null},{"id":"W2887275990","doi":"","title":"Research Guides: Graduate Specialist Program (New Brunswick Libraries): Text Analysis in R","year":2018,"lang":"en","type":"libguides","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Library science; World Wide Web; Medical education; Computer science; Medicine","score_opus":0.23683833164684012,"score_gpt":0.49000178412765777,"score_spread":0.2531634524808176,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2887275990","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022195955,0.002189385,0.1912492,0.024186742,0.0051344354,0.0034226046,0.30567467,0.15051676,0.31540665],"genre_scores_gemma":[0.0113101415,0.003356374,0.2421553,0.0059122825,0.0019044963,0.010347823,0.11454827,0.108254954,0.5022104],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99269354,0.0026695963,0.0007885056,0.0011840959,0.0024101983,0.00025406864],"domain_scores_gemma":[0.899258,0.04338896,0.0033511142,0.010782068,0.038062073,0.005157812],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.011879073,0.0018641532,0.0019158972,0.008596411,0.0014687811,0.0039397534,0.0027290261,0.0015726486,0.5631904],"category_scores_gemma":[0.14850849,0.0013794,0.0008228979,0.009262074,0.0012217555,0.003444467,0.002610504,0.0035311782,0.5090381],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004316891,0.000025987092,0.0001224991,0.00034135598,0.000005461875,0.000015994143,0.00010978026,0.0001075346,0.00016779416,0.0016385391,0.9492957,0.04812629],"study_design_scores_gemma":[0.0001207363,0.000045313005,0.0011245247,0.00068587816,0.00002077685,0.00008067862,0.00020306835,0.0011879018,0.0017387314,0.009342271,0.98539865,0.000051470888],"about_ca_topic_score_codex":0.0102469,"about_ca_topic_score_gemma":0.027287861,"teacher_disagreement_score":0.5631904,"about_ca_system_score_codex":0.0017413676,"about_ca_system_score_gemma":0.012535833,"threshold_uncertainty_score":0.6230559},"labels":[],"label_agreement":null},{"id":"W2889291357","doi":"10.1017/pan.2018.30","title":"Ideological Scaling of Social Media Users: A Dynamic Lexicon Approach","year":2018,"lang":"en","type":"article","venue":"Political Analysis","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Université Laval","funders":"University of Cambridge; Ministère de l'Économie, de la Science et de l'Innovation - Québec; Compute Canada; Université Laval","keywords":"Ideology; Social media; Voting behavior; Lexicon; Politics; Voting; Dimension (graph theory); Rhetoric; Sociology; Computer science; Political science; Linguistics; Artificial intelligence; Law; Mathematics; World Wide Web","score_opus":0.06638905123520183,"score_gpt":0.4087408830263073,"score_spread":0.34235183179110545,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2889291357","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3650187,0.00047788056,0.60438067,0.0012836664,0.00010892355,0.0006709094,0.0030793115,0.0006060119,0.024373896],"genre_scores_gemma":[0.8863655,0.00014607617,0.10949672,0.000094662864,0.000100083606,0.0006667295,0.0016891139,0.00009868506,0.0013425193],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9956117,0.002326533,0.00030332527,0.0009441947,0.0006386566,0.0001755778],"domain_scores_gemma":[0.98153025,0.013922385,0.0015937634,0.0016322875,0.001040803,0.00028058985],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038665836,0.0005807362,0.00082382717,0.008680145,0.0013859529,0.0048352643,0.0011292418,0.0008682817,0.0031528957],"category_scores_gemma":[0.03665362,0.0005149004,0.00096833706,0.006090068,0.0019175758,0.005175007,0.0030136383,0.0010970529,0.0009227694],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005615852,0.00085816404,0.13616827,0.00059090875,0.0005833551,0.0006411146,0.020423194,0.02346293,0.010087119,0.29247984,0.006342283,0.5078012],"study_design_scores_gemma":[0.00008528243,0.00014801722,0.07080494,0.00015915559,0.00014138337,0.00042759028,0.00760382,0.55733764,0.0026335288,0.34724712,0.013264795,0.00014670703],"about_ca_topic_score_codex":0.002407346,"about_ca_topic_score_gemma":0.0027086833,"teacher_disagreement_score":0.008680145,"about_ca_system_score_codex":0.0013095596,"about_ca_system_score_gemma":0.00085068,"threshold_uncertainty_score":0.020448685},"labels":[],"label_agreement":null},{"id":"W2891886878","doi":"10.23889/ijpds.v3i4.760","title":"Learning Unsupervised Representations from Biomedical Text","year":2018,"lang":"en","type":"article","venue":"International Journal for Population Data Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University Health Network; Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Computer science; Topic model; Natural language processing; Word2vec; Information retrieval; Statistical model; Artificial intelligence; Data science; Embedding","score_opus":0.13435178578016807,"score_gpt":0.511399824377993,"score_spread":0.377048038597825,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2891886878","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06100664,0.0033455517,0.90025127,0.0031137224,0.0006727071,0.00035596965,0.010763729,0.01283283,0.0076575833],"genre_scores_gemma":[0.5631311,0.002920233,0.3554221,0.0013136964,0.001672701,0.00093358645,0.055747528,0.00070245686,0.018156625],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986357,0.00035265964,0.000098675155,0.00055421423,0.00023403132,0.00012464148],"domain_scores_gemma":[0.9956404,0.0026985288,0.00032505303,0.00065939286,0.00056419394,0.000112299545],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016765504,0.0011478278,0.00080475514,0.0028123134,0.00057076354,0.0018847361,0.0019383885,0.0015812297,0.0056520673],"category_scores_gemma":[0.008957567,0.0004197147,0.0012964285,0.0032344763,0.00084971794,0.0023526822,0.0015152798,0.0019050137,0.0034922427],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034578695,0.00037513435,0.0046202093,0.0005342555,0.00020647065,0.00036638218,0.00026687633,0.18219903,0.006016827,0.01338113,0.05875916,0.73292875],"study_design_scores_gemma":[0.00003020593,0.00006320199,0.0012008606,0.00007290172,0.00003505871,0.00012641259,0.000079988495,0.9629088,0.0031197304,0.023558835,0.008778397,0.000025687492],"about_ca_topic_score_codex":0.005075152,"about_ca_topic_score_gemma":0.0053333943,"teacher_disagreement_score":0.0056520673,"about_ca_system_score_codex":0.0012145037,"about_ca_system_score_gemma":0.0014413745,"threshold_uncertainty_score":0.018908083},"labels":[],"label_agreement":null},{"id":"W2893586385","doi":"10.1167/18.10.447","title":"The role of perceptual and contextual information in social event segmentation","year":2018,"lang":"en","type":"article","venue":"Journal of Vision","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Event (particle physics); Perception; Social cue; Segmentation; Context (archaeology); Cognitive psychology; Parsing; Psychology; Social environment; Identification (biology); Contextual design; Computer science; Artificial intelligence; Object (grammar); Sociology; Geography","score_opus":0.017652407710019483,"score_gpt":0.38779564283690604,"score_spread":0.37014323512688657,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2893586385","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8990938,0.0006506221,0.07802006,0.000322613,0.000105717685,0.00026037358,0.00043811073,0.00038133955,0.020727409],"genre_scores_gemma":[0.98124576,0.0001454242,0.017703552,0.00004836476,0.0000296409,0.00006590737,0.0002150916,0.00009798597,0.00044837463],"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","domain_scores_codex":[0.99859625,0.00040794018,0.00006878078,0.0005338158,0.00023059307,0.00016261303],"domain_scores_gemma":[0.9927406,0.0037388927,0.0014876096,0.00083417655,0.0007267939,0.00047201576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017146857,0.00052277814,0.00042025262,0.0011081478,0.0008173757,0.0027890692,0.0006342512,0.00064874196,0.0030853401],"category_scores_gemma":[0.021731297,0.0005344358,0.0005051064,0.00070860295,0.001459207,0.003698837,0.0014856361,0.0007420512,0.00042880277],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004504345,0.0006349228,0.11472803,0.0014064619,0.0004708854,0.0011726498,0.016473185,0.015183167,0.5378081,0.021393497,0.0027298902,0.28349477],"study_design_scores_gemma":[0.0001090457,0.0013004775,0.7829097,0.00034083237,0.00043308365,0.00072125794,0.007917145,0.09497688,0.068570465,0.03519725,0.0071852757,0.00033855397],"about_ca_topic_score_codex":0.0024736207,"about_ca_topic_score_gemma":0.0030678397,"teacher_disagreement_score":0.0030853401,"about_ca_system_score_codex":0.0006442613,"about_ca_system_score_gemma":0.00069262786,"threshold_uncertainty_score":0.010321498},"labels":[],"label_agreement":null},{"id":"W2896956732","doi":"10.7910/dvn/b0ny7y","title":"Replication Data for: How to survey about electoral turnout? The efficacy of the face-saving response items in 19 different contexts","year":2016,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Western University; Université de Montréal","funders":"","keywords":"Turnout; Replication (statistics); Face (sociological concept); Political science; Psychology; Internet privacy; Face-to-face; Voter turnout; Survey data collection; Computer science; Sociology; Biology; Statistics; Mathematics; Social science; Virology; Politics; Law; Voting; Epistemology","score_opus":0.09105974544777569,"score_gpt":0.38862882445645713,"score_spread":0.29756907900868146,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2896956732","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010787951,0.00007856488,0.0007552399,0.00044329872,0.00013207654,0.00022361253,0.99485403,0.0009281759,0.0015062413],"genre_scores_gemma":[0.003068988,0.000051701554,0.0030791813,0.00016442177,0.000030178193,0.0015480055,0.9897939,0.00026822425,0.001995576],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99500304,0.0014546287,0.0009917434,0.0011021628,0.0010881996,0.00036029244],"domain_scores_gemma":[0.97574675,0.0062088985,0.0017505137,0.0106143765,0.0048874673,0.0007920449],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01106032,0.0017290423,0.0013847694,0.0022280675,0.0012976367,0.0027082916,0.004280326,0.002469942,0.06510151],"category_scores_gemma":[0.062129304,0.000984944,0.0014686504,0.0038591437,0.00091190793,0.001753323,0.0029652936,0.0027865348,0.084436156],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019019135,0.000069924594,0.004145858,0.00061304396,0.00006409499,0.000040432176,0.000116459945,0.0002568378,0.00022512859,0.0010173369,0.9871301,0.006130574],"study_design_scores_gemma":[0.0015924599,0.00008172883,0.015690656,0.00046447734,0.000084387706,0.00012758396,0.00030316,0.0010231413,0.0010726555,0.004290141,0.975195,0.00007449718],"about_ca_topic_score_codex":0.01564268,"about_ca_topic_score_gemma":0.04009339,"teacher_disagreement_score":0.06510151,"about_ca_system_score_codex":0.0015388634,"about_ca_system_score_gemma":0.0041008913,"threshold_uncertainty_score":0.21778625},"labels":[],"label_agreement":null},{"id":"W2898962309","doi":"10.5539/cis.v11n4p77","title":"Topic Modelling in Bangla Language: An LDA Approach to Optimize Topics and News Classification","year":2018,"lang":"en","type":"article","venue":"Computer and Information Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Computer science; Latent Dirichlet allocation; Topic model; Bengali; Natural language processing; Bigram; Artificial intelligence; Language model; Similarity (geometry); Information retrieval; Categorization; Popularity; Document clustering; Cluster analysis; Trigram","score_opus":0.06869610714418223,"score_gpt":0.3682764751611717,"score_spread":0.29958036801698945,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2898962309","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0143326605,0.0017298013,0.9793117,0.00059262116,0.00014600398,0.00012878505,0.00056862575,0.00079963723,0.0023900804],"genre_scores_gemma":[0.33191139,0.003041926,0.6436038,0.00037545725,0.0008128254,0.0008879194,0.003399581,0.0006635891,0.015303573],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982071,0.000839455,0.00013185067,0.0004212087,0.00026386045,0.00013655938],"domain_scores_gemma":[0.9983215,0.0010764718,0.00012291511,0.0001384906,0.0002801934,0.00006050345],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022753358,0.0009869834,0.0014735914,0.0023604543,0.0010914645,0.0026628303,0.0014391456,0.0011963431,0.002418353],"category_scores_gemma":[0.0049434546,0.00059781806,0.002147873,0.0031569055,0.0006177176,0.002183431,0.0012268715,0.0015505126,0.002133784],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053410913,0.00038596487,0.0075654676,0.000627065,0.0006721275,0.00035975946,0.001658182,0.18642476,0.008929342,0.04742341,0.022269202,0.7231506],"study_design_scores_gemma":[0.000028358843,0.000061890685,0.0018976138,0.000040270774,0.00009818343,0.00016753348,0.00021203658,0.9588206,0.0017892037,0.026876755,0.009951636,0.000055975357],"about_ca_topic_score_codex":0.006585066,"about_ca_topic_score_gemma":0.007829938,"teacher_disagreement_score":0.006585066,"about_ca_system_score_codex":0.0011053934,"about_ca_system_score_gemma":0.0010768105,"threshold_uncertainty_score":0.0130934715},"labels":[],"label_agreement":null},{"id":"W2899168816","doi":"10.1007/s11842-018-9411-8","title":"Modelling Research Topic Trends in Community Forestry","year":2018,"lang":"en","type":"article","venue":"Small-scale Forestry","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Bibliometrics; Latin Americans; Regional science; Topic model; Geography; Political science; Library science; Data science; Computer science; Information retrieval","score_opus":0.24136024230905437,"score_gpt":0.46174047492192033,"score_spread":0.22038023261286596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2899168816","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.88348234,0.0008441074,0.09687695,0.0018841177,0.00010230067,0.00025266423,0.0074487785,0.00043700953,0.008671798],"genre_scores_gemma":[0.96732706,0.000364789,0.02475777,0.000050032584,0.000052137453,0.00021893677,0.0031510482,0.000061588325,0.004016619],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998654,0.0007598441,0.00008291584,0.0002908379,0.00010673503,0.000105678424],"domain_scores_gemma":[0.97512054,0.02210671,0.0010280635,0.00043074845,0.0009390506,0.00037492518],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0034262775,0.0003878348,0.00037118493,0.0034583616,0.00050475675,0.0024513612,0.0010582065,0.0009891957,0.0060285944],"category_scores_gemma":[0.021265605,0.0002592675,0.0008188464,0.0054905186,0.00057256594,0.0034308853,0.0007130774,0.0009000298,0.0010140771],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00089811103,0.00056925206,0.22165035,0.0009862009,0.0004696677,0.00046554563,0.004921118,0.5175854,0.0019272256,0.07173987,0.010485142,0.1683022],"study_design_scores_gemma":[0.000039353545,0.00006261981,0.024077889,0.00006947874,0.0000826699,0.000052645948,0.0017865556,0.93099546,0.00049953087,0.03681203,0.0054997443,0.000022084245],"about_ca_topic_score_codex":0.037211597,"about_ca_topic_score_gemma":0.059393737,"teacher_disagreement_score":0.99657375,"about_ca_system_score_codex":0.0020727224,"about_ca_system_score_gemma":0.0015541501,"threshold_uncertainty_score":0.07398999},"labels":[],"label_agreement":null},{"id":"W2900532930","doi":"10.1111/joes.12370","title":"ECONOMETRICS MEETS SENTIMENT: AN OVERVIEW OF METHODOLOGY AND APPLICATIONS","year":2020,"lang":"en","type":"article","venue":"Journal of Economic Surveys","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":137,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Innoviris; Vrije Universiteit Brussel; Institut de Valorisation des Données; European Commission; Universiteit Gent; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; National Science Foundation","keywords":"Econometrics; Econometric model; Field (mathematics); Econometric analysis; Economics; Sentiment analysis; Computer science; Artificial intelligence; Mathematics","score_opus":0.47942152403492777,"score_gpt":0.4705475097426656,"score_spread":0.008874014292262145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2900532930","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016875627,0.052045815,0.90730757,0.01622155,0.0010383344,0.00042871592,0.0012917342,0.0010380767,0.018940765],"genre_scores_gemma":[0.08571722,0.117250755,0.7681383,0.0053781224,0.009365521,0.0026896256,0.001849279,0.0011819007,0.008429322],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9831292,0.0121907,0.0010698779,0.00086323614,0.0025037199,0.00024321517],"domain_scores_gemma":[0.9389213,0.051396187,0.0018531083,0.0029126168,0.0043027773,0.0006140653],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02449385,0.0014616527,0.0022987176,0.010757157,0.00094305706,0.006344237,0.0018161729,0.0028615324,0.011519574],"category_scores_gemma":[0.06905397,0.001217894,0.0019175366,0.01311682,0.0028072963,0.0052781687,0.0030516826,0.0038744744,0.006419611],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000059824422,0.000109810666,0.005027909,0.0033104909,0.0002796993,0.00024717156,0.00061623263,0.0075088763,0.0007260843,0.4404673,0.03800601,0.50364065],"study_design_scores_gemma":[0.00004070922,0.000045841156,0.0042234925,0.0020512748,0.00005700472,0.00029377636,0.00035539907,0.034048703,0.0005262719,0.76171285,0.19655137,0.000093410425],"about_ca_topic_score_codex":0.0023126185,"about_ca_topic_score_gemma":0.0011531399,"teacher_disagreement_score":0.02449385,"about_ca_system_score_codex":0.0019117338,"about_ca_system_score_gemma":0.002941853,"threshold_uncertainty_score":0.12953746},"labels":[],"label_agreement":null},{"id":"W2905534457","doi":"10.7202/1054277ar","title":"L’analyse des grands réseaux évolutifs et la sociologie pragmatique des controverses","year":2018,"lang":"fr","type":"article","venue":"Sociologie et sociétés","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Humanities; Sociology; Philosophy","score_opus":0.41747857782998066,"score_gpt":0.5770855404617746,"score_spread":0.15960696263179397,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2905534457","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10362432,0.058473047,0.37139258,0.24092765,0.0028548513,0.00024456313,0.0004513803,0.000458887,0.22157273],"genre_scores_gemma":[0.83479416,0.0289769,0.081452146,0.0068687177,0.0023766772,0.00064566993,0.00035255577,0.0005869357,0.043946248],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9748182,0.0150299305,0.0010329062,0.0030761927,0.0053588594,0.00068389403],"domain_scores_gemma":[0.90783155,0.077375636,0.0033317006,0.0052995547,0.0053880257,0.0007734374],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.032634348,0.0010797112,0.0011982044,0.010034372,0.010188058,0.022483027,0.0037114362,0.006783298,0.009184317],"category_scores_gemma":[0.05512021,0.0007611201,0.0013170175,0.008766905,0.042544924,0.036230683,0.008448083,0.0075609656,0.0014326724],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000016564958,0.000017374836,0.00065785216,0.00025576339,0.000025433452,0.00014580147,0.038112745,0.0004498773,0.0003002204,0.9362128,0.00203023,0.021775352],"study_design_scores_gemma":[0.000010522301,0.00002721555,0.001526702,0.0008838301,0.000030667685,0.00038678458,0.036104076,0.0020354474,0.0010153156,0.7193165,0.23859644,0.00006651453],"about_ca_topic_score_codex":0.008082865,"about_ca_topic_score_gemma":0.010810017,"teacher_disagreement_score":0.98981196,"about_ca_system_score_codex":0.012405702,"about_ca_system_score_gemma":0.008490311,"threshold_uncertainty_score":0.172589},"labels":[],"label_agreement":null},{"id":"W2908882000","doi":"10.3386/w25429","title":"How Does Scientific Progress Affect Cultural Changes? A Digital Text Analysis","year":2019,"lang":"en","type":"report","venue":"National Bureau of Economic Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Affect (linguistics); Data science; Computer science; Psychology; Communication","score_opus":0.4194674362147799,"score_gpt":0.5880463222317006,"score_spread":0.16857888601692073,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2908882000","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97407556,0.00088661566,0.004472351,0.0023639093,0.00008322004,0.00014174578,0.007081804,0.00008305338,0.01081166],"genre_scores_gemma":[0.986226,0.0006954557,0.0068770093,0.00020797677,0.00015930476,0.0001953407,0.003779377,0.000040472038,0.0018189576],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9977188,0.0010124986,0.00023403285,0.0003773709,0.0005498826,0.00010745023],"domain_scores_gemma":[0.9573822,0.03185807,0.005851466,0.0014008906,0.0030583723,0.00044889763],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0024441273,0.00025024163,0.00022726493,0.007046995,0.0008945543,0.0031446815,0.00041418837,0.00046273146,0.0038960327],"category_scores_gemma":[0.025885846,0.00013893879,0.00030381687,0.009751453,0.0013277605,0.0039761392,0.0012728556,0.00067381444,0.0008673655],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006308178,0.000573573,0.54486763,0.0017195273,0.00028047414,0.0010183578,0.05401244,0.0023670257,0.0121448245,0.021950101,0.013956873,0.34647825],"study_design_scores_gemma":[0.000062010586,0.00027647646,0.80670774,0.00049499987,0.000252984,0.0005953632,0.06478276,0.027811943,0.011002972,0.019110376,0.06876972,0.00013257403],"about_ca_topic_score_codex":0.003813831,"about_ca_topic_score_gemma":0.0034884815,"teacher_disagreement_score":0.99755585,"about_ca_system_score_codex":0.0013171975,"about_ca_system_score_gemma":0.0006873731,"threshold_uncertainty_score":0.013033509},"labels":[],"label_agreement":null},{"id":"W2909609490","doi":"10.22148/16.031","title":"Race, Writing, and Computation: Racial Difference and the US Novel, 1880-2000","year":2019,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Race (biology); Computation; Racial differences; Sociology; Computer science; Gender studies; Ethnic group; Anthropology; Programming language","score_opus":0.03399302375473869,"score_gpt":0.35616223997810736,"score_spread":0.3221692162233687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2909609490","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.29167396,0.024519462,0.0018291472,0.10165091,0.0022820816,0.00002470591,0.00028934522,0.000046688063,0.5776837],"genre_scores_gemma":[0.95823175,0.0027548855,0.00036486314,0.0033471237,0.0005082909,0.000024208439,0.00004294182,0.000046665125,0.034679223],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9984301,0.0009720244,0.0000490344,0.00019810564,0.00016825936,0.00018241543],"domain_scores_gemma":[0.99789387,0.0013337543,0.00025030595,0.00014288742,0.00022135164,0.0001578922],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025562015,0.0002489955,0.00025705667,0.0015655354,0.010182213,0.004293242,0.00035508082,0.0010736116,0.005120891],"category_scores_gemma":[0.0066333096,0.00012146762,0.00013406978,0.0020883041,0.012983653,0.004175162,0.0019902873,0.002678544,0.00041874818],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008916726,0.000025603631,0.0014061116,0.000042101725,0.0000064403716,0.0001943562,0.21528791,0.00005554831,0.000090658905,0.71522856,0.03369215,0.033881437],"study_design_scores_gemma":[0.000026422633,0.000041497857,0.007421412,0.00040807473,0.0000112166135,0.00048817426,0.089282595,0.00020239248,0.0005562748,0.115285166,0.78625214,0.000024502328],"about_ca_topic_score_codex":0.014392505,"about_ca_topic_score_gemma":0.025702665,"teacher_disagreement_score":0.014392505,"about_ca_system_score_codex":0.00394919,"about_ca_system_score_gemma":0.0018229202,"threshold_uncertainty_score":0.028653562},"labels":[],"label_agreement":null},{"id":"W2910284294","doi":"10.1177/0094306118815500a","title":"Cross-National Public Opinion about Homosexuality: Examining Attitudes across the Globe","year":2019,"lang":"en","type":"article","venue":"Contemporary Sociology A Journal of Reviews","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Globe; Homosexuality; Public opinion; Political science; Psychology; Social psychology; Media studies; Sociology; Law; Politics","score_opus":0.30712782087280605,"score_gpt":0.5088393270783492,"score_spread":0.20171150620554318,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2910284294","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9697179,0.015405514,0.00024427526,0.004889873,0.00015909976,0.000015272577,0.0005355632,0.0000044045296,0.0090280855],"genre_scores_gemma":[0.9894382,0.008489157,0.00012199509,0.00085045566,0.0001373121,0.000023056198,0.0003241422,0.000005432456,0.0006104273],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99710864,0.0015063012,0.00020495249,0.00025218798,0.00072450505,0.00020352537],"domain_scores_gemma":[0.97535,0.012754379,0.0061269407,0.0008452819,0.0038526605,0.0010707543],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005175127,0.00016706517,0.00050500483,0.0022575336,0.00069295167,0.0025624633,0.00041383,0.0010196865,0.0030233187],"category_scores_gemma":[0.01918854,0.00015227633,0.0004258257,0.0044746227,0.0012398042,0.001996764,0.0014874253,0.001129769,0.00035090934],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005394982,0.0002213404,0.7876046,0.0018402276,0.0011764007,0.00025513247,0.068619214,0.00012545762,0.0006632016,0.0034626566,0.0058224346,0.12966979],"study_design_scores_gemma":[0.0000112944035,0.00010367863,0.9427534,0.0012033568,0.0003023948,0.00013263115,0.04502783,0.00018273847,0.00019076766,0.0007381972,0.009330049,0.000023696664],"about_ca_topic_score_codex":0.013852467,"about_ca_topic_score_gemma":0.017858079,"teacher_disagreement_score":0.013852467,"about_ca_system_score_codex":0.00085485575,"about_ca_system_score_gemma":0.0012106495,"threshold_uncertainty_score":0.027543664},"labels":[],"label_agreement":null},{"id":"W2915547389","doi":"10.22148/16.033","title":"Could Fiction Have an Information History? Statistical Probability and the Rise of the Novel","year":2019,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Meaning (existential); Phenomenon; History of literature; Literary science; Psychology; History; Epistemology; Literature; Linguistics; Sociology; Literary criticism; Art; Philosophy","score_opus":0.050218066700435195,"score_gpt":0.3391083479877508,"score_spread":0.2888902812873156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2915547389","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11261647,0.0576662,0.09250191,0.36517498,0.006512415,0.00007117035,0.0012096185,0.00041374925,0.36383352],"genre_scores_gemma":[0.95579976,0.008903324,0.008286813,0.005311198,0.0071548,0.000048569764,0.00025581106,0.00020128614,0.014038443],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9957203,0.0023444358,0.00017732102,0.0008866213,0.0006317342,0.0002396366],"domain_scores_gemma":[0.9188921,0.067483954,0.0033593033,0.005287205,0.0033879601,0.0015894746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0108791925,0.00035273508,0.0008811934,0.004270241,0.00444534,0.013265627,0.0010448965,0.00301478,0.009557404],"category_scores_gemma":[0.071993984,0.0005843115,0.0005687878,0.0036517316,0.034784533,0.022003299,0.0031526934,0.0054638227,0.0012993327],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000038868064,0.000008689029,0.00085537514,0.00006604911,0.00001437877,0.00013232109,0.002960757,0.00033198265,0.000042146563,0.9780699,0.006616979,0.010862464],"study_design_scores_gemma":[0.000010392356,0.000015877733,0.0011863516,0.00016847359,0.000009368266,0.0002554207,0.0010496998,0.00109677,0.0001237499,0.9324774,0.06358013,0.000026297765],"about_ca_topic_score_codex":0.0020073394,"about_ca_topic_score_gemma":0.0013362399,"teacher_disagreement_score":0.013265627,"about_ca_system_score_codex":0.004415638,"about_ca_system_score_gemma":0.0014781097,"threshold_uncertainty_score":0.05753535},"labels":[],"label_agreement":null},{"id":"W2917452130","doi":"10.1002/wcc.576","title":"Frontiers in data analytics for adaptation research: Topic modeling","year":2019,"lang":"en","type":"article","venue":"Wiley Interdisciplinary Reviews Climate Change","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":64,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Adaptation (eye); Corporate governance; Leverage (statistics); Data science; Topic model; Convention; Climate change adaptation; Vulnerability (computing); Political science; Climate change; Computer science; Sociology; Social science; Business; Ecology","score_opus":0.661302599603033,"score_gpt":0.5346772663937048,"score_spread":0.12662533320932812,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2917452130","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008556634,0.027817678,0.90905446,0.040928017,0.00067051325,0.0005237316,0.004900708,0.0010956153,0.0064526373],"genre_scores_gemma":[0.21780019,0.028892267,0.73276955,0.0041338387,0.0043972814,0.0022405526,0.007078578,0.00048276124,0.0022049642],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9718868,0.020392865,0.0016374988,0.0032076235,0.0026268468,0.0002483329],"domain_scores_gemma":[0.78606164,0.1942783,0.004333099,0.01010074,0.0040782867,0.0011479454],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03890215,0.0016828465,0.0029611965,0.011581718,0.0016672926,0.013730364,0.0036281713,0.003242004,0.003924277],"category_scores_gemma":[0.111316375,0.0010638306,0.002869233,0.018489547,0.0045649456,0.015864773,0.0055861385,0.0074992757,0.0020346602],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017268816,0.00030722198,0.024711186,0.0042182985,0.00086676236,0.0003117254,0.0052680876,0.028858399,0.0012729202,0.44335416,0.037810195,0.4528484],"study_design_scores_gemma":[0.000031221534,0.00004580056,0.0035455106,0.0009542344,0.00007062948,0.00015124561,0.0019502428,0.16888018,0.0004236837,0.78340334,0.040454894,0.00008896903],"about_ca_topic_score_codex":0.004205671,"about_ca_topic_score_gemma":0.0033648852,"teacher_disagreement_score":0.03890215,"about_ca_system_score_codex":0.0033511976,"about_ca_system_score_gemma":0.004529995,"threshold_uncertainty_score":0.2057367},"labels":[],"label_agreement":null},{"id":"W2936242438","doi":"10.1177/2053951719839433","title":"What are neural networks <i>not</i> good at? On artificial creativity","year":2019,"lang":"en","type":"article","venue":"Big Data & Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Creativity; Artificial neural network; Scope (computer science); Computer science; Artificial intelligence; Extrapolation; Sociology; Cognitive science; Psychology; Social psychology; Mathematics","score_opus":0.18321867859015584,"score_gpt":0.38280388535365095,"score_spread":0.19958520676349512,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2936242438","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.037015658,0.28770804,0.0767086,0.42304426,0.0041252677,0.00003068486,0.00016981954,0.00022295947,0.1709747],"genre_scores_gemma":[0.68379927,0.22336008,0.024704663,0.037016146,0.011843915,0.00013214479,0.00011255271,0.00020835621,0.01882285],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9974406,0.0014636773,0.00011279469,0.00024995118,0.0005631603,0.0001697995],"domain_scores_gemma":[0.9880558,0.010074679,0.00031534093,0.00048649716,0.0008144155,0.00025327026],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0059725796,0.00056615,0.00077736005,0.0018377973,0.0015827436,0.0064275726,0.0012854206,0.002441542,0.0038820582],"category_scores_gemma":[0.01486279,0.000320987,0.00046214781,0.0017556011,0.010074148,0.015705515,0.0020300383,0.0036527799,0.00097489],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006571918,0.000027353228,0.00081012247,0.00033586263,0.00006870425,0.000096712014,0.00095298525,0.004491496,0.00020588496,0.85874355,0.01247326,0.12172836],"study_design_scores_gemma":[0.000008147365,0.000018348435,0.00039276612,0.000606325,0.0000117133,0.000061511826,0.0005092383,0.0037623222,0.00019711493,0.9657875,0.02862286,0.000022259823],"about_ca_topic_score_codex":0.0013382935,"about_ca_topic_score_gemma":0.001367148,"teacher_disagreement_score":0.0064275726,"about_ca_system_score_codex":0.0015796805,"about_ca_system_score_gemma":0.000815251,"threshold_uncertainty_score":0.03158641},"labels":[],"label_agreement":null},{"id":"W2937052695","doi":"10.3138/jsp.50.3.03","title":"CJK Languages or English: Languages Used by Academic Journals in China, Japan, and Korea","year":2019,"lang":"en","type":"article","venue":"Journal of Scholarly Publishing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"China; English language; Metadata; Library science; History; Computer science; World Wide Web; Mathematics education; Psychology","score_opus":0.03622785434903873,"score_gpt":0.37659568386975156,"score_spread":0.3403678295207128,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2937052695","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8354567,0.034842893,0.0012843838,0.0016102995,0.00041142773,0.0013886277,0.099851966,0.00029424287,0.02485954],"genre_scores_gemma":[0.9173156,0.021353751,0.008674961,0.0012542921,0.00031850926,0.0022349453,0.041825235,0.0002646762,0.006758015],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99279284,0.0009001396,0.0035424982,0.0006814195,0.0014885322,0.00059467944],"domain_scores_gemma":[0.96413946,0.00857574,0.017232105,0.0011983189,0.006689572,0.0021649082],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.004809255,0.0007177448,0.0009494074,0.039314814,0.0015848768,0.003495854,0.0009117372,0.0004226436,0.008988639],"category_scores_gemma":[0.025282875,0.00028000987,0.00062192546,0.06450609,0.001121397,0.0037018394,0.002146459,0.00045730438,0.001711647],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00091603975,0.00013786096,0.7496688,0.023384413,0.00065331755,0.0032067015,0.02918524,0.00016880933,0.00404626,0.0034281705,0.02319563,0.16200872],"study_design_scores_gemma":[0.0000640314,0.00012738805,0.8874618,0.0034194633,0.000625321,0.002589833,0.02534492,0.00023129226,0.0016593965,0.0007908418,0.07755954,0.00012626995],"about_ca_topic_score_codex":0.013626693,"about_ca_topic_score_gemma":0.023666713,"teacher_disagreement_score":0.99519074,"about_ca_system_score_codex":0.0019666988,"about_ca_system_score_gemma":0.00665523,"threshold_uncertainty_score":0.030070007},"labels":[],"label_agreement":null},{"id":"W2943121181","doi":"10.5465/annals.2017.0099","title":"Topic Modeling in Management Research: Rendering New Theory from Textual Data","year":2019,"lang":"en","type":"article","venue":"Academy of Management Annals","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":591,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University of Alberta","funders":"","keywords":"Rendering (computer graphics); Computer science; Novelty; Data science; Grounded theory; Topic model; Artificial intelligence; Sociology; Qualitative research; Social science","score_opus":0.5970884422744959,"score_gpt":0.5250309813464068,"score_spread":0.07205746092808907,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2943121181","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00616895,0.004242915,0.96921587,0.011987288,0.0004577546,0.000270204,0.00040251605,0.00055434176,0.006700053],"genre_scores_gemma":[0.17256889,0.0074091167,0.81024116,0.0020724856,0.00220233,0.0018426531,0.0007263532,0.0005852224,0.0023519148],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95895123,0.033044152,0.001917379,0.0022700308,0.003424558,0.00039256425],"domain_scores_gemma":[0.75953054,0.21968555,0.0040296866,0.012762932,0.003013552,0.0009776938],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05415823,0.0014704347,0.0017319566,0.018659204,0.003416422,0.02001383,0.0034549087,0.0034804842,0.0054575587],"category_scores_gemma":[0.12636608,0.0014384586,0.0025041467,0.014373815,0.0146723315,0.03321538,0.007976783,0.00619147,0.0012574436],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000803599,0.00008696778,0.0030684634,0.0015379578,0.00012459994,0.00016927307,0.02971963,0.0057714465,0.0010554616,0.79115635,0.006711671,0.16051784],"study_design_scores_gemma":[0.000035575715,0.00003084517,0.0007969753,0.0008769651,0.000047588863,0.00012301201,0.0054524518,0.027043134,0.00071031635,0.9215944,0.04322448,0.00006423538],"about_ca_topic_score_codex":0.0020617072,"about_ca_topic_score_gemma":0.002238594,"teacher_disagreement_score":0.9458418,"about_ca_system_score_codex":0.0050781313,"about_ca_system_score_gemma":0.0044674594,"threshold_uncertainty_score":0.2864195},"labels":[],"label_agreement":null},{"id":"W2951231787","doi":"10.22439/dansoc.v29i1.5741","title":"Køn og metodevalg blandt samfundsvidenskabelige specialeskrivende","year":2018,"lang":"da","type":"article","venue":"Dansk Sociologi","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"oskar; Humanities; Sociology; Professionalization; Psychology; Philosophy; Art; Art history; Social science","score_opus":0.09143560386152118,"score_gpt":0.4364655239830709,"score_spread":0.34502992012154976,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2951231787","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21913454,0.00885316,0.04247391,0.036502127,0.0010322816,0.00037691707,0.0044781677,0.00043061827,0.6867183],"genre_scores_gemma":[0.80455214,0.005567795,0.014959657,0.002167016,0.0003422414,0.00038017196,0.0020745553,0.00038697204,0.16956948],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99515027,0.0019107665,0.00022520332,0.0009011364,0.0011697637,0.0006428399],"domain_scores_gemma":[0.9935243,0.003374865,0.00072012114,0.0006700569,0.0010244731,0.0006861497],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0044475184,0.0007904552,0.0008518367,0.0017672931,0.0030455538,0.009561345,0.0012799217,0.0020459518,0.0813741],"category_scores_gemma":[0.013367116,0.0006680768,0.0010600913,0.002272908,0.003361321,0.0065790676,0.004860906,0.0027724141,0.01067866],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049743935,0.00051268854,0.068894364,0.0020795057,0.00027369033,0.0010614784,0.055373278,0.0030038299,0.0030920682,0.5024059,0.070470124,0.29233566],"study_design_scores_gemma":[0.00005106181,0.00020832314,0.078556895,0.0015932793,0.00015825176,0.00069657806,0.04962402,0.0026559087,0.00227474,0.14847852,0.7155553,0.0001471483],"about_ca_topic_score_codex":0.016160656,"about_ca_topic_score_gemma":0.022609772,"teacher_disagreement_score":0.9955525,"about_ca_system_score_codex":0.0052067568,"about_ca_system_score_gemma":0.0051796217,"threshold_uncertainty_score":0.27222353},"labels":[],"label_agreement":null},{"id":"W2951503732","doi":"10.2139/ssrn.3062061","title":"Measuring and Explaining Political Sophistication Through Textual Complexity","year":2017,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Trinity College","funders":"","keywords":"Sophistication; Politics; Political science; Political economy; Economics; Sociology; Social science; Law","score_opus":0.15808691170571962,"score_gpt":0.4041291427341269,"score_spread":0.2460422310284073,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2951503732","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97482795,0.00013198402,0.011998021,0.00038269925,0.000010727703,0.00005663644,0.0008160996,0.00006771058,0.011708202],"genre_scores_gemma":[0.996938,0.000037712678,0.00215506,0.000014849761,0.000023655895,0.000026901704,0.00028886663,0.000014593794,0.00050047785],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99642533,0.001819826,0.00026115662,0.00041736974,0.00087844563,0.00019781236],"domain_scores_gemma":[0.8328504,0.14442053,0.014319271,0.0041121286,0.003158425,0.0011393179],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036772648,0.00033346025,0.00037886755,0.0066873278,0.0006661256,0.003683152,0.0005016998,0.00078408286,0.008207248],"category_scores_gemma":[0.07284331,0.0002719225,0.00036248378,0.0058703595,0.0012351613,0.006514773,0.0016618771,0.000957897,0.0008421122],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036543832,0.00038631583,0.8488096,0.00036850807,0.0003246329,0.0003134273,0.011420956,0.013417993,0.004657075,0.040834364,0.0020527188,0.07704886],"study_design_scores_gemma":[0.00008143017,0.0002195593,0.69632196,0.00019782332,0.00028752506,0.00035461393,0.007811912,0.1697742,0.0050007035,0.11143456,0.008403199,0.00011256476],"about_ca_topic_score_codex":0.0017728539,"about_ca_topic_score_gemma":0.002454048,"teacher_disagreement_score":0.008207248,"about_ca_system_score_codex":0.0008383664,"about_ca_system_score_gemma":0.00050548546,"threshold_uncertainty_score":0.027456045},"labels":[],"label_agreement":null},{"id":"W2954019746","doi":"","title":"Proximity and Networked News Public: Structural Topic Modeling of Global Twitter Conversations about the 2017 Quebec Mosque Shooting","year":2019,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Narrative; Storytelling; Social media; Media studies; Sociology; Advertising; Political science; Law; Business","score_opus":0.33580891375902516,"score_gpt":0.5745134379825657,"score_spread":0.23870452422354055,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2954019746","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9868826,0.00021886989,0.009370144,0.00055128906,0.00001706959,0.00006476202,0.0006973002,0.000044787736,0.0021532062],"genre_scores_gemma":[0.99635065,0.00009768323,0.0023976348,0.000025275622,0.000020569327,0.00006258707,0.000548849,0.000010570596,0.00048631348],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9992367,0.00040818276,0.000027472111,0.00017724301,0.000059548664,0.00009084774],"domain_scores_gemma":[0.99497825,0.0040633427,0.00049797795,0.00014815462,0.0001731383,0.00013918993],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018437216,0.00046662093,0.00044227706,0.001703951,0.0008665749,0.0022953148,0.0005214476,0.0006989497,0.0022128609],"category_scores_gemma":[0.008472439,0.0002671734,0.00083895854,0.0017349882,0.0006321902,0.001909666,0.0012489283,0.0009964596,0.0003596907],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012434084,0.00059149036,0.7090731,0.00046917328,0.00065607496,0.00079963956,0.04593164,0.13775218,0.0030544759,0.028391823,0.003920155,0.06811681],"study_design_scores_gemma":[0.00005060598,0.00013879646,0.12133885,0.00008454137,0.00016372306,0.00010352733,0.017998688,0.84220463,0.0006119031,0.013177115,0.0040826644,0.000045015084],"about_ca_topic_score_codex":0.059804816,"about_ca_topic_score_gemma":0.049739797,"teacher_disagreement_score":0.9401952,"about_ca_system_score_codex":0.0014980499,"about_ca_system_score_gemma":0.00089991785,"threshold_uncertainty_score":0.11891347},"labels":[],"label_agreement":null},{"id":"W2954211942","doi":"10.1017/pan.2019.26","title":"Word Embeddings for the Analysis of Ideological Placement in Parliamentary Corpora","year":2019,"lang":"en","type":"article","venue":"Political Analysis","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":165,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Ideology; Metadata; Parliament; Computer science; Context (archaeology); Politics; Word (group theory); Natural language processing; Language model; Linguistics; Artificial intelligence; Data science; Sociology; Political science; World Wide Web; Law; History","score_opus":0.0491700587411518,"score_gpt":0.39750142558781854,"score_spread":0.3483313668466667,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2954211942","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14657316,0.000847662,0.8410559,0.00083020155,0.00019273818,0.0001797388,0.0044316407,0.0017764557,0.0041124164],"genre_scores_gemma":[0.6527936,0.0005202238,0.3331651,0.00012344691,0.00012443267,0.0007691974,0.009010492,0.00044969225,0.0030437435],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99807966,0.001132824,0.00015122928,0.0003352782,0.00022846964,0.000072592644],"domain_scores_gemma":[0.99116313,0.0060902974,0.00089387456,0.0011332431,0.0005753563,0.00014417733],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029812737,0.00076236215,0.00040668374,0.0029551787,0.00082576997,0.0018701036,0.0007007482,0.0008099245,0.003794079],"category_scores_gemma":[0.022395846,0.0003959334,0.0007372224,0.004168221,0.0009957369,0.004091859,0.0016634316,0.002218788,0.0017810964],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049577473,0.0005202418,0.042878926,0.0007385371,0.00044393982,0.0002946585,0.0030602592,0.15314955,0.010851418,0.11013558,0.0191697,0.65826136],"study_design_scores_gemma":[0.000034421773,0.00012396515,0.011118895,0.000119819524,0.00004789968,0.00017866972,0.0007654727,0.84453577,0.0028899373,0.12703583,0.013091756,0.000057522615],"about_ca_topic_score_codex":0.0025360833,"about_ca_topic_score_gemma":0.005868912,"teacher_disagreement_score":0.003794079,"about_ca_system_score_codex":0.00089287077,"about_ca_system_score_gemma":0.0007929655,"threshold_uncertainty_score":0.01576668},"labels":[],"label_agreement":null},{"id":"W2959196931","doi":"","title":"Subtypes of denial and minimization in sexual offenders using exploratory factor analysis","year":2019,"lang":"en","type":"article","venue":"MacEwan University Student Research Proceedings","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"MacEwan University","funders":"","keywords":"Denial; Psychology; Exploratory factor analysis; Social psychology; Criminology; Clinical psychology; Psychotherapist; Psychometrics","score_opus":0.18628531727781428,"score_gpt":0.44229870700983764,"score_spread":0.25601338973202337,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2959196931","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.998178,0.000051869054,0.00037712802,0.00014843361,0.000007364704,0.00009861743,0.00014395133,0.0000045372367,0.0009900846],"genre_scores_gemma":[0.99836,0.000028617756,0.0010090088,0.000017334569,0.000005114759,0.000112568494,0.00024331194,0.000005137452,0.00021901971],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99616987,0.0015239803,0.0006239714,0.00031924158,0.0009033432,0.00045958906],"domain_scores_gemma":[0.99034977,0.0043181945,0.0023972725,0.0010704817,0.0011949913,0.0006692613],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004890416,0.0004434431,0.0007102432,0.00236448,0.0025958626,0.0029404184,0.000901178,0.000609494,0.002624767],"category_scores_gemma":[0.025269829,0.0003364907,0.0015019508,0.0019435929,0.0010259427,0.0020813923,0.0025996407,0.0018183775,0.00016980132],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027119298,0.0003015102,0.96594274,0.00005166266,0.00014032202,0.000119771095,0.016457347,0.00018102927,0.00039863776,0.0015796191,0.00038547418,0.014170556],"study_design_scores_gemma":[0.000024416606,0.00017313033,0.9569204,0.00008839842,0.00008345555,0.0004737864,0.036037706,0.0014424378,0.00026863223,0.0036371497,0.0008115071,0.000038862916],"about_ca_topic_score_codex":0.0113647245,"about_ca_topic_score_gemma":0.01723503,"teacher_disagreement_score":0.0113647245,"about_ca_system_score_codex":0.0019196102,"about_ca_system_score_gemma":0.003254478,"threshold_uncertainty_score":0.02586329},"labels":[],"label_agreement":null},{"id":"W2964419261","doi":"10.22215/etd/2018-12716","title":"Identification of Topics and Their Evolution in Management Science: Replicating and Extending an Expert Analysis Using Semi-Automated Methods","year":2018,"lang":"en","type":"dissertation","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Latent Dirichlet allocation; Computer science; Identification (biology); Process (computing); Topic model; Data science; Software; Generative grammar; Software engineering; Graphical user interface; Software development; Information retrieval; Artificial intelligence","score_opus":0.04902644844207598,"score_gpt":0.48682823771485234,"score_spread":0.43780178927277635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2964419261","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.26958406,0.0016801084,0.7180495,0.0019596708,0.000121773286,0.0010149163,0.00054325233,0.0006290764,0.006417525],"genre_scores_gemma":[0.5755285,0.00058412546,0.4199437,0.00018998406,0.00011441329,0.00127218,0.00072324876,0.00019842148,0.0014453385],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9608134,0.028716827,0.0015190245,0.004946956,0.0035865563,0.00041734628],"domain_scores_gemma":[0.6829542,0.2724839,0.011253955,0.02091385,0.01158278,0.000811421],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.062675774,0.00069035526,0.00083867356,0.008354704,0.0018415747,0.0073864344,0.002260788,0.0016890407,0.001999866],"category_scores_gemma":[0.19923621,0.000730627,0.0017255414,0.006812721,0.002857875,0.009601523,0.004277814,0.0018813665,0.0007286272],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047360835,0.0004126771,0.110324636,0.0018500539,0.00066279643,0.00081754103,0.08930868,0.031767268,0.0066407924,0.090091355,0.0040390957,0.66361153],"study_design_scores_gemma":[0.00017074734,0.0003461004,0.06867339,0.0013950799,0.0004945146,0.00071846676,0.02514478,0.50294614,0.009124799,0.357663,0.032961067,0.0003619972],"about_ca_topic_score_codex":0.0044016778,"about_ca_topic_score_gemma":0.005047138,"teacher_disagreement_score":0.9916453,"about_ca_system_score_codex":0.0029055397,"about_ca_system_score_gemma":0.002710129,"threshold_uncertainty_score":0.33146513},"labels":[],"label_agreement":null},{"id":"W2967741816","doi":"","title":"Social Media Data, Machine Learning and Causal Inference","year":2019,"lang":"en","type":"article","venue":"Journal of the Association for Information Systems","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Computer science; Social media; Artificial intelligence; Causal inference; Inference; Machine learning; Data science; Natural language processing; World Wide Web; Econometrics","score_opus":0.04886245868015036,"score_gpt":0.36874222005492396,"score_spread":0.3198797613747736,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2967741816","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02401426,0.0032059322,0.94698304,0.01394006,0.00038282902,0.00051884516,0.0014275204,0.00028760012,0.009239951],"genre_scores_gemma":[0.4801743,0.0034977484,0.50843096,0.0019098741,0.0010985286,0.002003866,0.0012605694,0.00011362215,0.0015106036],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96120596,0.031281218,0.0011659526,0.0029511251,0.0029896474,0.00040610373],"domain_scores_gemma":[0.6851702,0.28326017,0.012802518,0.0141316345,0.0036544038,0.0009811328],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04145156,0.0015952255,0.0014057223,0.0079455115,0.0026243313,0.006451243,0.0029213699,0.0028779746,0.0049966816],"category_scores_gemma":[0.12986833,0.0011169651,0.0015611397,0.007208907,0.011087275,0.012011797,0.004888733,0.00497237,0.00045069456],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007600052,0.00021170027,0.009477059,0.0009234377,0.000428663,0.00032691815,0.0016715643,0.020982353,0.00030247774,0.9108339,0.0033365402,0.051429387],"study_design_scores_gemma":[0.00002707202,0.00002697324,0.0012339862,0.00022221518,0.00004096327,0.000072477436,0.0004675467,0.040317014,0.00033831332,0.9519707,0.005250269,0.0000323272],"about_ca_topic_score_codex":0.0046354705,"about_ca_topic_score_gemma":0.0042615724,"teacher_disagreement_score":0.04145156,"about_ca_system_score_codex":0.0035467446,"about_ca_system_score_gemma":0.0043783872,"threshold_uncertainty_score":0.21921939},"labels":[],"label_agreement":null},{"id":"W2971947976","doi":"10.1515/sem-2018-0110","title":"Raw data or hypersymbols? Meaning-making with digital data, between discursive processes and machinic procedures","year":2019,"lang":"en","type":"article","venue":"Semiotica","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Semiotics; Epistemology; Big data; Sociology; Rhetorical question; Meaning (existential); Value (mathematics); Social semiotics; Context (archaeology); Computer science; Data science; Linguistics; Philosophy","score_opus":0.09072691165092146,"score_gpt":0.3995020730323609,"score_spread":0.30877516138143946,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2971947976","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.046656948,0.0197621,0.5218757,0.100330636,0.002357462,0.00030739902,0.00035740843,0.00028747728,0.30806488],"genre_scores_gemma":[0.9027799,0.005458337,0.07587735,0.0034354997,0.0010585416,0.00043474179,0.0001248799,0.0001885553,0.010642174],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9784071,0.016520558,0.00079129444,0.0013026218,0.002603968,0.00037442663],"domain_scores_gemma":[0.9663176,0.02577649,0.0015904122,0.004013271,0.0017643083,0.00053792517],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02101204,0.0006195427,0.0006595609,0.004301552,0.004230696,0.017496854,0.0014530566,0.0025868458,0.0031547062],"category_scores_gemma":[0.03255743,0.00044035472,0.00053367176,0.0036071385,0.102275044,0.025999637,0.0064776214,0.004080079,0.0007106304],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000067741103,0.000003060946,0.00005392822,0.000030643063,0.0000021683263,0.000024581783,0.0054785754,0.00006384018,0.000055793917,0.99118376,0.0004703322,0.002626632],"study_design_scores_gemma":[0.0000066789735,0.0000063778757,0.000073417614,0.00015061171,0.000002759326,0.000049382663,0.0042027216,0.0004674369,0.00024550498,0.9642066,0.03057888,0.00000964044],"about_ca_topic_score_codex":0.0013090046,"about_ca_topic_score_gemma":0.0009738642,"teacher_disagreement_score":0.02101204,"about_ca_system_score_codex":0.0043282313,"about_ca_system_score_gemma":0.003193102,"threshold_uncertainty_score":0.11112362},"labels":[],"label_agreement":null},{"id":"W2975162275","doi":"10.2196/14763","title":"Mining Hidden Knowledge About Illegal Compensation for Occupational Injury: Topic Model Approach","year":2019,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Research Foundation of Korea; National Research Foundation","keywords":"Workers' compensation; Latent Dirichlet allocation; Compensation (psychology); Actuarial science; Occupational injury; Social media; Topic model; Business; Psychology; Computer science; Injury prevention; Medicine; Political science; Poison control; Law; Environmental health; Natural language processing; Social psychology","score_opus":0.060711810281671275,"score_gpt":0.41035744200945473,"score_spread":0.34964563172778346,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2975162275","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3937945,0.009555297,0.5713053,0.0049163266,0.0004519161,0.0007827986,0.013063495,0.0020139893,0.0041164034],"genre_scores_gemma":[0.8645438,0.0032205863,0.11017837,0.00041762067,0.00083460595,0.0007619064,0.016950909,0.000108056716,0.0029842006],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9971788,0.0008852312,0.00033013624,0.0010157399,0.00030969986,0.00028043348],"domain_scores_gemma":[0.98880416,0.009178988,0.0007855192,0.00043102793,0.00060426653,0.00019605878],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038729582,0.0015571298,0.0015759855,0.009042244,0.0012413723,0.002810887,0.0019786505,0.0023512244,0.0012947416],"category_scores_gemma":[0.009307251,0.00086742244,0.0039413404,0.005228366,0.00079126726,0.004042499,0.0015930975,0.0023599202,0.0008362704],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015845158,0.002124246,0.21697237,0.002848718,0.002961612,0.0033275604,0.0085389195,0.22435583,0.010417391,0.021593561,0.029528145,0.4757471],"study_design_scores_gemma":[0.000053655804,0.00012106615,0.016849281,0.00018717235,0.00048734318,0.00048181554,0.001295423,0.9560204,0.001498561,0.01760445,0.0053289053,0.00007194005],"about_ca_topic_score_codex":0.011301584,"about_ca_topic_score_gemma":0.012885291,"teacher_disagreement_score":0.011301584,"about_ca_system_score_codex":0.001422009,"about_ca_system_score_gemma":0.0019041699,"threshold_uncertainty_score":0.022471607},"labels":[],"label_agreement":null},{"id":"W2982232129","doi":"10.21226/ewjus524","title":"Mark von Hagen (21 July 1954-14 September 2019)","year":2019,"lang":"en","type":"article","venue":"East/West Journal of Ukrainian Studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Georgetown University","keywords":"Obituary; Art; Art history; History; Archaeology","score_opus":0.05859574616489945,"score_gpt":0.39001573296927944,"score_spread":0.33141998680438,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2982232129","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020418752,0.04050076,0.0021560004,0.08972068,0.2526806,0.00012707192,0.007693514,0.002680149,0.6023993],"genre_scores_gemma":[0.0036696398,0.002390975,0.0002781587,0.0027609817,0.002904123,0.000021294354,0.0007110422,0.0003908426,0.9868729],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99898666,0.00011061252,0.00004716682,0.00022638649,0.00045716588,0.00017203747],"domain_scores_gemma":[0.9990094,0.000118465236,0.00008657378,0.000070113536,0.00046185873,0.0002536126],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0010972484,0.0007045624,0.00075609377,0.0009926576,0.0023204607,0.0043575675,0.00075848604,0.002001519,0.3331609],"category_scores_gemma":[0.0048389714,0.0003505928,0.00032747156,0.0006867674,0.00076653267,0.002234859,0.003593922,0.0018212498,0.26880312],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003168969,0.000003684441,0.000050058316,0.00003728791,0.000001801918,0.000039467504,0.00002985102,0.000033707936,0.00007488016,0.0022360794,0.9826645,0.014797015],"study_design_scores_gemma":[0.0000020786094,0.0000030088381,0.00010066291,0.000030313568,8.6077654e-7,0.0000142332065,0.00002504986,0.000014244395,0.00008086687,0.000424044,0.9993006,0.000003974409],"about_ca_topic_score_codex":0.010224938,"about_ca_topic_score_gemma":0.020635521,"teacher_disagreement_score":0.3331609,"about_ca_system_score_codex":0.0017961473,"about_ca_system_score_gemma":0.002173612,"threshold_uncertainty_score":0.951165},"labels":[],"label_agreement":null},{"id":"W2990909818","doi":"10.1017/s1049096519001732","title":"Analysis of Text-Analysis Syllabi: Building a Text-Analysis Syllabus Using Scaling","year":2019,"lang":"en","type":"article","venue":"PS Political Science & Politics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; University of Toronto; Université de Montréal","funders":"Université Laval","keywords":"Syllabus; Variety (cybernetics); Field (mathematics); Computer science; Rank (graph theory); Mathematics education; Artificial intelligence; Psychology; Mathematics","score_opus":0.0510488252297131,"score_gpt":0.4261477139350056,"score_spread":0.3750988887052925,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2990909818","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24556036,0.007592959,0.39587545,0.0043464787,0.0029574097,0.2405831,0.07416015,0.0045613847,0.024362674],"genre_scores_gemma":[0.13017255,0.0014416634,0.67055833,0.0004823185,0.00024754618,0.17677881,0.017277298,0.0004922677,0.0025491747],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.8850758,0.051899116,0.032167,0.0059995484,0.023700807,0.001157694],"domain_scores_gemma":[0.46960235,0.340517,0.04229969,0.020008132,0.12373133,0.003841561],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08994569,0.0014568842,0.0021978698,0.042503297,0.0037704543,0.0044168644,0.0021319147,0.00072008657,0.010548777],"category_scores_gemma":[0.40083197,0.0011961823,0.0028989122,0.027224407,0.001845395,0.0037260146,0.0063875006,0.0019777883,0.0021903443],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080203684,0.0006220333,0.037578322,0.06032839,0.000856261,0.00058070075,0.025277125,0.0022960417,0.013361144,0.018408645,0.050326988,0.7895623],"study_design_scores_gemma":[0.0011894905,0.0014886247,0.19700724,0.060684446,0.002979894,0.0006637201,0.047316905,0.042988535,0.0480377,0.0720635,0.52414167,0.0014382559],"about_ca_topic_score_codex":0.00580905,"about_ca_topic_score_gemma":0.010713581,"teacher_disagreement_score":0.9100543,"about_ca_system_score_codex":0.0076551484,"about_ca_system_score_gemma":0.022347776,"threshold_uncertainty_score":0.47568393},"labels":[],"label_agreement":null},{"id":"W2991039843","doi":"10.1075/ahs.10","title":"Keeping in Touch","year":2019,"lang":"en","type":"book","venue":"Advances in historical sociolinguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science","score_opus":0.031136280567454547,"score_gpt":0.37710197420615593,"score_spread":0.3459656936387014,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2991039843","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016606178,0.03768571,0.0076573933,0.0571208,0.02603597,0.000057343976,0.00038122517,0.0008282183,0.86857283],"genre_scores_gemma":[0.0069399537,0.018450798,0.004455876,0.015659083,0.00795495,0.000037521593,0.00032455576,0.00074987963,0.9454274],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9984688,0.00029236032,0.00007205293,0.00028241542,0.00076913415,0.00011527065],"domain_scores_gemma":[0.9979248,0.00059791654,0.00008366584,0.00037721594,0.0006734774,0.00034297886],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010929586,0.00072173955,0.0007193304,0.0016786292,0.0034416134,0.011236924,0.0014430892,0.0025538988,0.1205038],"category_scores_gemma":[0.004575779,0.00034261847,0.0005998599,0.0020143373,0.003725402,0.010397298,0.0047709346,0.0056128195,0.10722056],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025377487,0.000031112606,0.00027222006,0.00029249967,0.000009013448,0.00011053669,0.002515614,0.00008411466,0.00065860234,0.08806848,0.7127632,0.19516918],"study_design_scores_gemma":[6.03458e-7,0.0000033810293,0.00006454592,0.000073355266,0.0000012752869,0.00007308523,0.0002226434,0.000009024155,0.000050517116,0.004271546,0.9952276,0.0000023373093],"about_ca_topic_score_codex":0.0019162712,"about_ca_topic_score_gemma":0.0063242004,"teacher_disagreement_score":0.1205038,"about_ca_system_score_codex":0.0017697436,"about_ca_system_score_gemma":0.0024846522,"threshold_uncertainty_score":0.40312535},"labels":[],"label_agreement":null},{"id":"W2993207549","doi":"10.6084/m9.figshare.7781051.v2","title":"Text-as-Data Analysis of Political Parties versus Government Parties: To Blend or not to Blend? The Appendix","year":2019,"lang":"en","type":"article","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Center for Interuniversity Research and Analysis on Organizations; Polytechnique Montréal","funders":"","keywords":"Government (linguistics); Political science; Computer science; Philosophy; Linguistics","score_opus":0.16596627858955762,"score_gpt":0.4274771428389928,"score_spread":0.26151086424943515,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2993207549","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018951568,0.00019705939,0.040100694,0.0037632922,0.0022275292,0.0010289501,0.87607944,0.032170948,0.042536832],"genre_scores_gemma":[0.043355886,0.000635118,0.19625205,0.0044450597,0.0016182663,0.010632757,0.5495884,0.0741339,0.11933849],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99674404,0.0010757163,0.0004619625,0.00068567164,0.00086462405,0.00016791548],"domain_scores_gemma":[0.89564294,0.07785147,0.0029219114,0.007259842,0.014981618,0.0013421649],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005153156,0.0011698066,0.00087374967,0.0034344953,0.0012609187,0.0031140163,0.0016306001,0.0012323762,0.71518844],"category_scores_gemma":[0.086805604,0.000829539,0.0012508461,0.004218351,0.0007144432,0.003521842,0.0022596817,0.0016852042,0.2808371],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000098581026,0.000022528964,0.00046888637,0.0003948538,0.000022058308,0.000024656965,0.00007970866,0.0000993436,0.00017341122,0.0020301996,0.9788976,0.017688224],"study_design_scores_gemma":[0.0003679744,0.00003660652,0.0044100177,0.0009106403,0.000047184476,0.00017681874,0.00040178277,0.002678774,0.0018338434,0.016571457,0.97247314,0.000091766306],"about_ca_topic_score_codex":0.0026983812,"about_ca_topic_score_gemma":0.005108989,"teacher_disagreement_score":0.71518844,"about_ca_system_score_codex":0.0014334059,"about_ca_system_score_gemma":0.0025214518,"threshold_uncertainty_score":0.4062491},"labels":[],"label_agreement":null},{"id":"W2994268587","doi":"10.22215/etd/2013-09928","title":"Incorrigible While Incarcerated: Topic Modeling Mainstream Canadian News Depictions of Ashley Smith","year":2013,"lang":"en","type":"dissertation","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Carleton University","funders":"","keywords":"Newspaper; Mainstream; Medicalization; Globe; Media studies; Prison; Terminology; Mental illness; News media; History; Criminology; Psychology; Sociology; Mental health; Political science; Psychiatry; Law","score_opus":0.04298700236913195,"score_gpt":0.3384893348015599,"score_spread":0.29550233243242796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2994268587","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96364677,0.0006280488,0.026984666,0.0008791377,0.00003182151,0.0003316453,0.0022518085,0.0001514497,0.005094621],"genre_scores_gemma":[0.97044736,0.00043895532,0.024722207,0.00006944659,0.000038269118,0.0002714312,0.0024450484,0.00004488567,0.001522432],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9986112,0.00070036313,0.000055771747,0.00031753955,0.00017123997,0.00014394186],"domain_scores_gemma":[0.9706899,0.026549991,0.001017524,0.0002862762,0.0012398183,0.00021654523],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004711931,0.0007492065,0.00047341886,0.0036573785,0.0017170087,0.004118913,0.0011507373,0.00085263775,0.0017240512],"category_scores_gemma":[0.018811563,0.00049489184,0.00079969334,0.003775833,0.0008545646,0.0017751151,0.0007744576,0.0011944473,0.00034650342],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015996968,0.00076754106,0.4596084,0.001112091,0.00064714946,0.00093747344,0.15907347,0.11516952,0.007017798,0.02731571,0.009681707,0.2170694],"study_design_scores_gemma":[0.000086115404,0.00010591486,0.08692862,0.00020906645,0.0002688794,0.00012026269,0.038414706,0.8531336,0.0016989227,0.007268431,0.011646977,0.000118469565],"about_ca_topic_score_codex":0.49951458,"about_ca_topic_score_gemma":0.49928373,"teacher_disagreement_score":0.5004854,"about_ca_system_score_codex":0.00578847,"about_ca_system_score_gemma":0.003482731,"threshold_uncertainty_score":0.9932142},"labels":[],"label_agreement":null},{"id":"W2994294451","doi":"","title":"Content analysis of big qualitative data","year":2019,"lang":"en","type":"article","venue":"International journal of open information technologies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Computer science; Content analysis; Data science; Coding (social sciences); Information retrieval; Big data; Artificial intelligence; Data mining; Sociology; Social science","score_opus":0.326431968508658,"score_gpt":0.5272113000389167,"score_spread":0.20077933153025868,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2994294451","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10840842,0.0041321735,0.6637884,0.011494439,0.0025787875,0.0461986,0.082495704,0.0035359291,0.07736752],"genre_scores_gemma":[0.22754076,0.0025133314,0.6490061,0.00240422,0.00063993473,0.078178905,0.02884038,0.001521364,0.0093549695],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.927138,0.04338775,0.0074169184,0.0052480046,0.015625872,0.0011834757],"domain_scores_gemma":[0.6641536,0.2316621,0.016877305,0.026035054,0.059824273,0.0014476449],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.074699715,0.0011733801,0.001624913,0.025738306,0.0031895451,0.0070579317,0.002329136,0.0010915544,0.013377616],"category_scores_gemma":[0.23621725,0.0007192766,0.0015435956,0.025688633,0.004047904,0.004815172,0.006188892,0.0015234061,0.0023959498],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006617487,0.00027647128,0.016373718,0.026938684,0.0005292452,0.0008164779,0.16022828,0.003074485,0.0075569064,0.1606339,0.08978706,0.5331229],"study_design_scores_gemma":[0.0002435921,0.00031326732,0.0270115,0.013294017,0.00041133797,0.00059149915,0.12643366,0.013139866,0.010454893,0.2014326,0.60632485,0.00034892044],"about_ca_topic_score_codex":0.0029682189,"about_ca_topic_score_gemma":0.00320557,"teacher_disagreement_score":0.9253003,"about_ca_system_score_codex":0.006420679,"about_ca_system_score_gemma":0.011025102,"threshold_uncertainty_score":0.39505458},"labels":[],"label_agreement":null},{"id":"W2994969675","doi":"10.21810/pop.2019.008","title":"Dispersed/Networked Open Social Discovery Research: Applications for Humanistic Machine Learning &amp; Topic Modelling","year":2019,"lang":"en","type":"article","venue":"Pop! Public Open Participatory","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Vancouver Island University","funders":"","keywords":"Scholarship; Coherence (philosophical gambling strategy); Social learning; Knowledge management; Perspective (graphical); Data science; Sociology; Computer science; Psychology; Political science; Artificial intelligence","score_opus":0.6799227994133192,"score_gpt":0.5623667590674459,"score_spread":0.1175560403458733,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2994969675","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006018846,0.00041219403,0.9854612,0.0013203493,0.000062967694,0.0002531647,0.00032906362,0.0010716646,0.0050706607],"genre_scores_gemma":[0.14764073,0.00049648684,0.8472177,0.00014763749,0.00012093636,0.0013763604,0.0004194663,0.00029901782,0.0022817769],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9913578,0.00667536,0.0003208885,0.00089212356,0.00062885636,0.00012504357],"domain_scores_gemma":[0.93303293,0.05914881,0.0016364424,0.004495582,0.0008157509,0.0008704729],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019759513,0.0009795224,0.001097972,0.0069767535,0.0030825268,0.008296795,0.0023676541,0.0024522475,0.0132342065],"category_scores_gemma":[0.05970481,0.00099246,0.0026588077,0.00550854,0.005123374,0.007038459,0.00724791,0.0027646467,0.0021155193],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013015539,0.0002150911,0.0076563423,0.00076861173,0.00022737807,0.0002472175,0.0080877505,0.06554743,0.0009869706,0.7269639,0.0060533937,0.18311572],"study_design_scores_gemma":[0.000033729502,0.00002391431,0.00073436735,0.00016721115,0.000023555365,0.00010323747,0.0011565953,0.41148674,0.00037250263,0.5729365,0.0129245045,0.000037161095],"about_ca_topic_score_codex":0.004517122,"about_ca_topic_score_gemma":0.0062810206,"teacher_disagreement_score":0.019759513,"about_ca_system_score_codex":0.0033171203,"about_ca_system_score_gemma":0.0026475654,"threshold_uncertainty_score":0.10449958},"labels":[],"label_agreement":null},{"id":"W2995952378","doi":"","title":"The Skies Over Canada: Observing Committee News","year":2005,"lang":"en","type":"article","venue":"Journal of the Royal Astronomical Society of Canada","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Political science","score_opus":0.011460552292868497,"score_gpt":0.2511590815522839,"score_spread":0.2396985292594154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2995952378","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006279525,0.018557435,0.0006174984,0.7814005,0.068867505,0.00014608368,0.012498275,0.0007533267,0.110879816],"genre_scores_gemma":[0.04893185,0.016911946,0.001377301,0.22824086,0.018128173,0.00012636081,0.009427195,0.00072252384,0.6761339],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99613684,0.00009763759,0.00011218208,0.00020752837,0.002618569,0.00082722347],"domain_scores_gemma":[0.9903071,0.00058492814,0.00026237732,0.00023485863,0.006486783,0.0021238897],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025421567,0.00076332135,0.0007215367,0.0022552717,0.008904783,0.007366889,0.0018343761,0.008355814,0.02377187],"category_scores_gemma":[0.007375695,0.0005161695,0.00093880895,0.0037365274,0.0021274267,0.0017221048,0.0019724579,0.00931516,0.006770534],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019838657,0.0000069072603,0.0007518342,0.00003442555,0.000006957585,0.000050360315,0.00007863795,0.00002807535,0.000055258475,0.0006625407,0.99337775,0.0049274196],"study_design_scores_gemma":[0.000009533468,0.000004173647,0.006415499,0.00007591294,0.000012184877,0.000021738286,0.00041735696,0.000051829236,0.00007874959,0.00021004557,0.9926859,0.000016938306],"about_ca_topic_score_codex":0.9644528,"about_ca_topic_score_gemma":0.98765403,"teacher_disagreement_score":0.035547197,"about_ca_system_score_codex":0.02786228,"about_ca_system_score_gemma":0.114483036,"threshold_uncertainty_score":0.20215595},"labels":[],"label_agreement":null},{"id":"W3000486466","doi":"10.31222/osf.io/5rksu","title":"Open Science Practices are on the Rise: The State of Social Science (3S) Survey","year":2019,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":137,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Transparency (behavior); Open science; Quarter (Canadian coin); Social science; Sociology; State (computer science); Science studies; Field (mathematics); Political science; Public relations; Geography; Law","score_opus":0.2535066719527609,"score_gpt":0.5222285857905022,"score_spread":0.26872191383774136,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3000486466","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98568696,0.0009145759,0.0005216481,0.004161977,0.000038503724,0.00006213329,0.0036321492,0.000024851859,0.0049571483],"genre_scores_gemma":[0.9949726,0.00080783025,0.00043540308,0.0008622532,0.0000643219,0.000099191406,0.0021720054,0.000015332731,0.0005710737],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98952395,0.0036726352,0.0014827343,0.0009210151,0.0034428083,0.0009568899],"domain_scores_gemma":[0.88053703,0.041749254,0.047015134,0.005619491,0.016666317,0.0084126815],"candidate_categories":["metaresearch","open_science"],"consensus_categories":[],"category_scores_codex":[0.012955103,0.00012921458,0.0003734115,0.0062292162,0.0008720942,0.0029990233,0.00064384146,0.0009908358,0.0021884535],"category_scores_gemma":[0.041802406,0.00029724487,0.0003801985,0.008399134,0.001534026,0.003226308,0.0027637833,0.0012948489,0.0005398502],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006692876,0.00007117501,0.9530813,0.00018161211,0.000057303412,0.000060973925,0.011848444,0.00006629232,0.00036128008,0.0016225248,0.0044732937,0.028108886],"study_design_scores_gemma":[0.0000046021714,0.00006418942,0.9665676,0.0001530983,0.000013156282,0.00010176946,0.016050655,0.00019969628,0.00017092742,0.00055655965,0.016094016,0.000023716952],"about_ca_topic_score_codex":0.008967833,"about_ca_topic_score_gemma":0.009112854,"teacher_disagreement_score":0.99935615,"about_ca_system_score_codex":0.0018921681,"about_ca_system_score_gemma":0.0026345567,"threshold_uncertainty_score":0.06851393},"labels":[],"label_agreement":null},{"id":"W3001831322","doi":"10.1080/01615440.2019.1684859","title":"Computational genealogy: Continuities and discontinuities in the political rhetoric of US presidents","year":2019,"lang":"en","type":"article","venue":"Historical Methods A Journal of Quantitative and Interdisciplinary History","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Rhetoric; Classification of discontinuities; Discontinuity (linguistics); Dissent; Politics; Epistemology; Contingency; Field (mathematics); Temporalities; History; Sociology; Genealogy; Political science; Philosophy; Linguistics; Law; Mathematics","score_opus":0.0709380121781449,"score_gpt":0.4277121197626408,"score_spread":0.3567741075844959,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3001831322","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9374766,0.00041934536,0.053008012,0.0018133039,0.000027944388,0.00004349711,0.0006888573,0.00019345412,0.006328908],"genre_scores_gemma":[0.9809731,0.00007827251,0.017963808,0.000051361305,0.000014032229,0.000039708248,0.00038715548,0.000023360824,0.00046913416],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9986462,0.0008100624,0.00006456185,0.00026979,0.0001571759,0.000052240615],"domain_scores_gemma":[0.9758649,0.02071394,0.0013114418,0.0014627889,0.00044898508,0.00019785369],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033558016,0.00014513517,0.00027821364,0.002170269,0.0011373428,0.0029401989,0.00083522795,0.00057038065,0.0025554323],"category_scores_gemma":[0.03593152,0.0002342555,0.00037381594,0.0020793779,0.0024232906,0.005101943,0.0017314918,0.000968809,0.00020106051],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057810405,0.00036157513,0.20984831,0.00043734827,0.0002227978,0.00057951716,0.040643137,0.09077884,0.0030221497,0.39286682,0.006777016,0.2538844],"study_design_scores_gemma":[0.000043953678,0.000089266105,0.05249889,0.00015178147,0.00007166176,0.00039461587,0.010820181,0.61586195,0.002347196,0.30444708,0.013209257,0.00006415692],"about_ca_topic_score_codex":0.0038846536,"about_ca_topic_score_gemma":0.005997697,"teacher_disagreement_score":0.0038846536,"about_ca_system_score_codex":0.0010326093,"about_ca_system_score_gemma":0.00075891876,"threshold_uncertainty_score":0.017747402},"labels":[],"label_agreement":null},{"id":"W3002419061","doi":"10.24908/pceea.vi0.13830","title":"WHO DO WE THINK WE ARE? COMPARING INTERSECTIONAL IDENTITY TRENDS IN ASEE AND CEEA-ACEG USING NATURAL LANGUAGE PROCESSING AND REVIEW OF PROCEEDINGS","year":2019,"lang":"en","type":"article","venue":"Proceedings of the Canadian Engineering Education Association (CEEA)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Toronto; University of British Columbia","funders":"University of Toronto","keywords":"Wonder; Subject (documents); Identity (music); Focus (optics); Object (grammar); Point (geometry); Data science; Natural (archaeology); Computer science; Macro; Artificial intelligence; Epistemology; Sociology; Linguistics; Natural language processing; Cognitive science; Psychology; History; World Wide Web; Aesthetics","score_opus":0.014408684933887434,"score_gpt":0.3079810344921675,"score_spread":0.2935723495582801,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3002419061","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4895124,0.30180088,0.0042020935,0.08482616,0.0024439592,0.0002608649,0.0059248563,0.00013658583,0.11089218],"genre_scores_gemma":[0.8692838,0.11098315,0.003521524,0.005597083,0.0007812429,0.00026806685,0.0038686998,0.000099276534,0.0055970512],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.98382854,0.0059775356,0.002258587,0.0015571594,0.005531605,0.00084664027],"domain_scores_gemma":[0.912385,0.05175691,0.010726853,0.003132655,0.019735403,0.0022632398],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.02248217,0.000288514,0.00076496165,0.035458937,0.0038170007,0.013760292,0.0015815195,0.0013650397,0.00424841],"category_scores_gemma":[0.08842111,0.00031850018,0.0005333066,0.03676369,0.005573682,0.017371928,0.0047842525,0.0026433822,0.0008077218],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016713163,0.00010401366,0.121227555,0.008697743,0.00040980478,0.0019899616,0.29955816,0.00029004744,0.0008508642,0.07470127,0.06040625,0.4315972],"study_design_scores_gemma":[0.0000098952405,0.000078762554,0.17033526,0.008316695,0.00015637124,0.0009818237,0.43119532,0.0002610227,0.0008260659,0.0076864646,0.3800411,0.00011126903],"about_ca_topic_score_codex":0.027529249,"about_ca_topic_score_gemma":0.046360053,"teacher_disagreement_score":0.9940826,"about_ca_system_score_codex":0.0059173713,"about_ca_system_score_gemma":0.0075921263,"threshold_uncertainty_score":0.11889851},"labels":[],"label_agreement":null},{"id":"W3003714380","doi":"10.22148/001c.11831","title":"Gender Dynamics and Critical Reception: A Study of Early 20th-century Book Reviews from The New York Times","year":2020,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Audience measurement; Publishing; Dynamics (music); Reading (process); Order (exchange); Lemma (botany); Taste; Copying; Scale (ratio); History; Sociology; Psychology; Literature; Political science; Law; Geography; Art; Cartography","score_opus":0.12925868815169114,"score_gpt":0.39672365252175396,"score_spread":0.26746496437006284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3003714380","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9831871,0.0025104857,0.00023835605,0.00087280315,0.000056551282,0.000018966002,0.00047218494,0.000009575611,0.012634138],"genre_scores_gemma":[0.99184227,0.0016196197,0.00023942052,0.00013056443,0.00013422003,0.000029436242,0.00056317245,0.000033958997,0.005407358],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.99859625,0.00056941796,0.00009997014,0.00011694428,0.0004883438,0.00012912038],"domain_scores_gemma":[0.9783554,0.0125616,0.0047982926,0.00035418966,0.0032756142,0.0006549245],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.002078093,0.00019973808,0.0003015993,0.0049457066,0.0016644645,0.0031986665,0.00035433096,0.00037749158,0.0031930672],"category_scores_gemma":[0.023030214,0.00017358054,0.00012015503,0.0054973243,0.001133081,0.0025002384,0.0009862408,0.0006098557,0.00057548645],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031425466,0.00011874457,0.2391844,0.0005198142,0.00007523731,0.0024623463,0.6455564,0.00014969677,0.0016612762,0.010851033,0.014361366,0.084745474],"study_design_scores_gemma":[0.00001227316,0.00007881336,0.647871,0.00039114975,0.00003468319,0.0008312486,0.2535111,0.0004728806,0.001102822,0.0012041827,0.094444975,0.000044858818],"about_ca_topic_score_codex":0.026283506,"about_ca_topic_score_gemma":0.05778497,"teacher_disagreement_score":0.9950543,"about_ca_system_score_codex":0.0023555537,"about_ca_system_score_gemma":0.0012889182,"threshold_uncertainty_score":0.052261055},"labels":[],"label_agreement":null},{"id":"W3004478131","doi":"10.22148/001c.11882","title":"Topic Modeling the Hàn diăn Ancient Classics (汉典古籍)","year":2017,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"College of Humanities and Social Sciences, United Arab Emirates University; Xi’an Jiaotong University; National Endowment for the Humanities","keywords":"Pinyin; Pronunciation; Topic model; Linguistics; Computer science; History; Natural language processing; Artificial intelligence; Chinese characters; Philosophy","score_opus":0.1623321213294615,"score_gpt":0.43606651150148973,"score_spread":0.2737343901720282,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3004478131","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3329178,0.0055239364,0.6369173,0.0037613218,0.00026100827,0.00030891478,0.0047397055,0.0010006843,0.014569262],"genre_scores_gemma":[0.88062453,0.0021876325,0.10212179,0.00018005386,0.0003105627,0.00039583922,0.0035862974,0.00017014008,0.010423242],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991685,0.0003528169,0.000048181526,0.000251315,0.000110091365,0.000069059904],"domain_scores_gemma":[0.9967884,0.0025336659,0.00013455223,0.00020502995,0.00025460336,0.000083738094],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023604017,0.00049520377,0.0005411575,0.0019092162,0.00082800025,0.002365506,0.00094844773,0.00058585167,0.0022810553],"category_scores_gemma":[0.007486379,0.00030980253,0.00089180964,0.0029091062,0.0007588056,0.0019258747,0.00078430306,0.0008386907,0.00053602416],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051342335,0.00022846078,0.04812582,0.0009781626,0.0005652776,0.00096050656,0.011296394,0.23711127,0.004115537,0.28722012,0.03088236,0.37800273],"study_design_scores_gemma":[0.00003534621,0.00003842265,0.013910064,0.00008738923,0.00010255933,0.00022918776,0.0012377042,0.87770194,0.0013902683,0.07961053,0.025606224,0.0000503768],"about_ca_topic_score_codex":0.01637367,"about_ca_topic_score_gemma":0.012732858,"teacher_disagreement_score":0.01637367,"about_ca_system_score_codex":0.0012484185,"about_ca_system_score_gemma":0.001161172,"threshold_uncertainty_score":0.032556713},"labels":[],"label_agreement":null},{"id":"W3008018357","doi":"10.22230/cjc.2020v45n1a3765","title":"Article Usage Analytics for the Canadian Journal of Communication 2015–2018: A Guide for Authors, Publishers, and Readers","year":2020,"lang":"en","type":"article","venue":"Canadian Journal of Communication","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Subject matter; Subject (documents); Presentation (obstetrics); Context (archaeology); Analytics; Style (visual arts); Library science; Computer science; Data science; History; Sociology; Medicine","score_opus":0.1229978471664857,"score_gpt":0.37967335143260766,"score_spread":0.25667550426612196,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3008018357","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020642336,0.0118180895,0.054705475,0.02592423,0.003338531,0.007547519,0.64746064,0.036603123,0.19196008],"genre_scores_gemma":[0.062781096,0.020116974,0.4610332,0.0054369443,0.0022729158,0.013664563,0.30752605,0.013509907,0.11365831],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9855107,0.001612922,0.001966136,0.00085559825,0.0091785,0.00087608537],"domain_scores_gemma":[0.8706188,0.030530479,0.009191638,0.0048762495,0.077477425,0.0073054438],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.015582492,0.0017961875,0.0013107961,0.05588354,0.005559673,0.013224893,0.002151685,0.00104767,0.04922256],"category_scores_gemma":[0.093361855,0.0011309469,0.0013160895,0.05417869,0.0017046063,0.006331567,0.003600726,0.0029188015,0.03595035],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000050831088,0.000057696085,0.007641989,0.0011954127,0.000023008519,0.000100898396,0.0036020926,0.00028556283,0.00083646557,0.0047768787,0.8116808,0.1697484],"study_design_scores_gemma":[0.000015035059,0.000029999124,0.021083575,0.0010989269,0.000018862254,0.00013747739,0.0028979538,0.00077297044,0.00056420156,0.002445474,0.97078615,0.00014945932],"about_ca_topic_score_codex":0.45075944,"about_ca_topic_score_gemma":0.67173684,"teacher_disagreement_score":0.9844175,"about_ca_system_score_codex":0.016693233,"about_ca_system_score_gemma":0.0638148,"threshold_uncertainty_score":0.89627147},"labels":[],"label_agreement":null},{"id":"W3008266615","doi":"10.1109/bigdata47090.2019.9006160","title":"Search for K: Assessing Five Topic-Modeling Approaches to 120,000 Canadian Articles","year":2019,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Simon Fraser University; University of British Columbia","funders":"","keywords":"Computer science; Information retrieval; Data science","score_opus":0.3375062790903245,"score_gpt":0.41583414767860083,"score_spread":0.07832786858827634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3008266615","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9500414,0.006372271,0.013477124,0.0015423904,0.00008780774,0.0007457439,0.015466599,0.0007496207,0.011517079],"genre_scores_gemma":[0.9596227,0.0012891211,0.01745319,0.00012474772,0.000071355535,0.00028054806,0.019661242,0.00011396744,0.0013831174],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98931295,0.0028868509,0.001220841,0.0019525653,0.003988273,0.0006386177],"domain_scores_gemma":[0.85395324,0.1048856,0.011033442,0.0048603355,0.022110265,0.0031571672],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.02039485,0.0010354,0.0012063283,0.01655955,0.0049529634,0.0054059387,0.0023128365,0.0019634792,0.002386821],"category_scores_gemma":[0.14213288,0.00051208434,0.0019724756,0.02394657,0.002190464,0.0039994214,0.0026034713,0.0013925809,0.00065321673],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025933105,0.0005745464,0.7442374,0.0031534454,0.002340594,0.0006143707,0.009704833,0.030849421,0.0016293763,0.008545341,0.026775878,0.16898157],"study_design_scores_gemma":[0.0005589823,0.00067196606,0.74094284,0.0007340182,0.0019285828,0.00061633915,0.010779954,0.20715076,0.0031441841,0.00839037,0.024733106,0.00034886735],"about_ca_topic_score_codex":0.56783026,"about_ca_topic_score_gemma":0.5640068,"teacher_disagreement_score":0.9837241,"about_ca_system_score_codex":0.016275857,"about_ca_system_score_gemma":0.015692208,"threshold_uncertainty_score":0.8694297},"labels":[],"label_agreement":null},{"id":"W3009223532","doi":"10.3390/philosophies5010004","title":"Breakthrough Knowledge Synthesis in the Age of Google","year":2020,"lang":"en","type":"article","venue":"Philosophies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Field (mathematics); Expansive; Data science; Selection (genetic algorithm); Knowledge extraction; Knowledge management; Body of knowledge; Artificial intelligence; Mathematics","score_opus":0.17153357837650365,"score_gpt":0.39545419689321204,"score_spread":0.2239206185167084,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3009223532","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03990131,0.07616137,0.66441554,0.0905795,0.007739711,0.0046135033,0.0052431393,0.0017860512,0.109559946],"genre_scores_gemma":[0.31259573,0.036772378,0.61378974,0.009772657,0.001999481,0.010192846,0.002855593,0.00081354904,0.011207978],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93021923,0.05006085,0.0038650846,0.0033314745,0.011648094,0.00087527785],"domain_scores_gemma":[0.82016796,0.14708354,0.003922978,0.016379304,0.011372664,0.001073519],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07308273,0.0011460127,0.002052912,0.01509317,0.0038673053,0.013264904,0.0026747482,0.003231165,0.009259606],"category_scores_gemma":[0.13622704,0.00074855034,0.0021712305,0.0142132435,0.008797373,0.016422953,0.0118738925,0.0043645366,0.0015388393],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024221634,0.00008636057,0.0010030358,0.011945476,0.0005501796,0.00027257396,0.03265625,0.0026529739,0.00085228856,0.6165177,0.021612048,0.31160885],"study_design_scores_gemma":[0.0001109916,0.00007722701,0.00063455844,0.006393863,0.00027569022,0.00009488501,0.011001523,0.002505871,0.0012311465,0.7389547,0.23865567,0.00006383103],"about_ca_topic_score_codex":0.003346121,"about_ca_topic_score_gemma":0.004963971,"teacher_disagreement_score":0.92691725,"about_ca_system_score_codex":0.008182792,"about_ca_system_score_gemma":0.01640975,"threshold_uncertainty_score":0.38650304},"labels":[],"label_agreement":null},{"id":"W3012579551","doi":"10.1353/srm.2010.0042","title":"Science and Sensation in Romantic Poetry by Noel Jackson","year":2010,"lang":"en","type":"article","venue":"Studies in Romanticism","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Romanticism; Poetry; Romance; Reading (process); Literature; Art; Art history; History; Philosophy","score_opus":0.04571336324339675,"score_gpt":0.44688643747393203,"score_spread":0.4011730742305353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3012579551","genre_codex":"review","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027019586,0.6199296,0.0012856359,0.2594782,0.052498322,0.000027219301,0.00007933118,0.000048980255,0.063950755],"genre_scores_gemma":[0.10604381,0.53265893,0.0024743974,0.061542276,0.09782586,0.00012443315,0.0001577763,0.0002633201,0.19890915],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99898237,0.00040510748,0.000041698375,0.00014587361,0.0003737745,0.00005109313],"domain_scores_gemma":[0.9975994,0.001341337,0.00014209065,0.00003862341,0.000585618,0.0002929636],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014466962,0.00089831033,0.00082515413,0.0021566572,0.0024140659,0.0033455405,0.00067353324,0.0016048233,0.008336161],"category_scores_gemma":[0.005354131,0.0003071674,0.00025851218,0.001975178,0.004339719,0.005668793,0.0018227302,0.004388868,0.003257798],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004484047,0.000023601116,0.0002195087,0.00045905172,0.000008614166,0.00011261289,0.0035618413,0.00016462422,0.00015370047,0.048038125,0.8876816,0.059531886],"study_design_scores_gemma":[0.000004485148,0.000009736463,0.00055057806,0.0005732952,0.000004164271,0.00022662806,0.0012615803,0.000083409424,0.000054356722,0.010773507,0.9864421,0.000016190193],"about_ca_topic_score_codex":0.005658167,"about_ca_topic_score_gemma":0.00787354,"teacher_disagreement_score":0.008336161,"about_ca_system_score_codex":0.0019420923,"about_ca_system_score_gemma":0.0018746129,"threshold_uncertainty_score":0.027887225},"labels":[],"label_agreement":null},{"id":"W3013971886","doi":"10.48550/arxiv.2003.13519","title":"QRMine: A python package for triangulation in Grounded Theory","year":2020,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Python (programming language); Computer science; Grounded theory; Coding (social sciences); Open source; Triangulation; Programming language; Artificial intelligence; Theoretical computer science; Qualitative research; Mathematics; Software","score_opus":0.20505992753838545,"score_gpt":0.2897400708312599,"score_spread":0.08468014329287446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3013971886","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028322665,0.00033232925,0.7758273,0.0018368155,0.00042382485,0.003294881,0.08298296,0.114215806,0.018253757],"genre_scores_gemma":[0.010017602,0.00022113287,0.9307783,0.0006247313,0.00004802745,0.014097563,0.015380741,0.022959363,0.005872531],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9912117,0.005347004,0.0010135346,0.00096660975,0.0011892774,0.00027182323],"domain_scores_gemma":[0.95471334,0.035941973,0.0017795586,0.0040052272,0.0030578002,0.00050219224],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017655196,0.0019821755,0.0016190738,0.0036692075,0.0018911527,0.0039331163,0.003906521,0.0010901142,0.1764897],"category_scores_gemma":[0.0646871,0.002593037,0.0033757077,0.0044535333,0.0018238557,0.0032608171,0.007989517,0.004495135,0.032650903],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00060572097,0.0002600167,0.0033564884,0.011225458,0.0007920561,0.0004365887,0.009533296,0.011328735,0.002842849,0.11229307,0.5055408,0.34178504],"study_design_scores_gemma":[0.00071430014,0.00010949572,0.0038212677,0.0024901866,0.00027148967,0.0002890203,0.0017151632,0.052260384,0.004593384,0.30011788,0.63328016,0.00033723554],"about_ca_topic_score_codex":0.005170031,"about_ca_topic_score_gemma":0.013941401,"teacher_disagreement_score":0.1764897,"about_ca_system_score_codex":0.0028440726,"about_ca_system_score_gemma":0.0088120205,"threshold_uncertainty_score":0.59041685},"labels":[],"label_agreement":null},{"id":"W3014909009","doi":"10.1177/0263395720914571","title":"Hindsight bias in expert surveys: How democratic crises influence retrospective evaluations","year":2020,"lang":"en","type":"article","venue":"Politics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Thomas University","funders":"","keywords":"Hindsight bias; Futures studies; Democracy; Population; Psychology; Cognitive bias; Cognition; Positive economics; Debiasing; Cognitive psychology; Social psychology; Political science; Economics; Sociology; Computer science; Demography; Law; Politics","score_opus":0.22478419286011825,"score_gpt":0.44966413884665885,"score_spread":0.2248799459865406,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3014909009","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7694631,0.0022606384,0.17651857,0.0076840078,0.0005113503,0.001339605,0.00083733245,0.0002925235,0.041092794],"genre_scores_gemma":[0.98391217,0.00026792396,0.012550167,0.0011834281,0.00019617239,0.00059097947,0.00023647476,0.00007887992,0.0009837052],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.5724991,0.37117618,0.015455918,0.01606939,0.022008758,0.0027905963],"domain_scores_gemma":[0.09294757,0.76185507,0.08432594,0.03140286,0.02810892,0.001359534],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.31311148,0.00073426944,0.00095303723,0.003972321,0.002218087,0.0067444816,0.0015398557,0.0018765783,0.003629644],"category_scores_gemma":[0.75318325,0.00073106855,0.0008323915,0.0038891733,0.004925555,0.006261732,0.0047811065,0.0026278596,0.0008789084],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001784559,0.0002952684,0.6158388,0.0014168329,0.0011005909,0.00047167248,0.14111461,0.005051958,0.0022368317,0.031845465,0.012650171,0.18619324],"study_design_scores_gemma":[0.00045852875,0.0011082146,0.64788514,0.003515392,0.0009049704,0.0011337451,0.07126266,0.060220014,0.008859179,0.15310125,0.050827116,0.0007238105],"about_ca_topic_score_codex":0.005900786,"about_ca_topic_score_gemma":0.004636854,"teacher_disagreement_score":0.31311148,"about_ca_system_score_codex":0.0031225695,"about_ca_system_score_gemma":0.0028426095,"threshold_uncertainty_score":0.84705585},"labels":[],"label_agreement":null},{"id":"W3016199438","doi":"10.2139/ssrn.3413443","title":"A Typology of UK Energy Service Brands Based on Size, Licencing and Source of Energy","year":2019,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Quest University Canada","funders":"","keywords":"Typology; Energy (signal processing); Service (business); Business; Marketing; Geography; Mathematics; Statistics","score_opus":0.007361918217985688,"score_gpt":0.2726890591987322,"score_spread":0.2653271409807465,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3016199438","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.87293285,0.00075223413,0.0053087818,0.0018953937,0.000119800556,0.00032251864,0.0061079436,0.00011398704,0.11244648],"genre_scores_gemma":[0.9818246,0.0002959333,0.0034254123,0.00019930875,0.0000165081,0.00015468642,0.001789613,0.000049691564,0.012244298],"study_design_codex":"observational","study_design_gemma":"qualitative","domain_scores_codex":[0.99820757,0.00042701638,0.00023271807,0.0001818156,0.00066933286,0.00028151125],"domain_scores_gemma":[0.99487984,0.0022132643,0.0008144863,0.00038635757,0.0013414912,0.000364519],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010676176,0.0002684406,0.00022933129,0.007953378,0.0013684024,0.0033857326,0.0005442677,0.00075314107,0.022475705],"category_scores_gemma":[0.008644672,0.00021611131,0.00039657406,0.0085628955,0.0020338325,0.003014965,0.0018602535,0.0005759455,0.00256736],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011231482,0.00029010107,0.46069416,0.001047113,0.000116555544,0.0013506071,0.08778113,0.0023354099,0.0063669193,0.17633459,0.055569325,0.20699093],"study_design_scores_gemma":[0.000064739725,0.00034685753,0.58958906,0.0013511479,0.00007547022,0.001609191,0.16528347,0.008256405,0.002167527,0.038269993,0.19279268,0.00019347278],"about_ca_topic_score_codex":0.016723981,"about_ca_topic_score_gemma":0.021680951,"teacher_disagreement_score":0.022475705,"about_ca_system_score_codex":0.002446627,"about_ca_system_score_gemma":0.0011399074,"threshold_uncertainty_score":0.0751887},"labels":[],"label_agreement":null},{"id":"W3019170642","doi":"10.1017/s0008423920000372","title":"(Un)Covering the COVID-19 Pandemic: Framing Analysis of the Crisis in Canada","year":2020,"lang":"en","type":"article","venue":"Canadian Journal of Political Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":73,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; Université Laval","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Pandemic; Framing (construction); Political science; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Crisis management; Economic history; Geography; History; Outbreak; Law; Medicine; Infectious disease (medical specialty); Virology","score_opus":0.07415035811355343,"score_gpt":0.3646452236737246,"score_spread":0.2904948655601712,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3019170642","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5550822,0.011066873,0.00537983,0.05522622,0.0006424635,0.0004649831,0.21628387,0.0005221463,0.15533145],"genre_scores_gemma":[0.90078723,0.0047801263,0.0043888004,0.002727789,0.00015995355,0.00017735087,0.058827065,0.00020424197,0.027947377],"study_design_codex":"not_applicable","study_design_gemma":"qualitative","domain_scores_codex":[0.9987275,0.00019243079,0.000044199816,0.00016776158,0.00049231894,0.00037585828],"domain_scores_gemma":[0.9919586,0.0013232571,0.0004671814,0.0003570412,0.004837487,0.0010564304],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001811165,0.0004020751,0.00036738094,0.004318381,0.005932748,0.004089689,0.00084614026,0.00064450235,0.008623371],"category_scores_gemma":[0.012194948,0.00019735393,0.0004907989,0.0111027565,0.0012094243,0.001231885,0.0015484418,0.0014154704,0.0010488329],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043705353,0.00012303666,0.23628722,0.0005922618,0.0002346424,0.0004156263,0.017083056,0.0049104514,0.00065550965,0.047342923,0.576393,0.1155252],"study_design_scores_gemma":[0.00006211428,0.00004362411,0.47243023,0.0008249427,0.00025834973,0.00010519855,0.051390205,0.018689333,0.0011161357,0.0087986,0.44606736,0.00021389428],"about_ca_topic_score_codex":0.9964575,"about_ca_topic_score_gemma":0.99723536,"teacher_disagreement_score":0.053451538,"about_ca_system_score_codex":0.053451538,"about_ca_system_score_gemma":0.060271274,"threshold_uncertainty_score":0.3878199},"labels":[],"label_agreement":null},{"id":"W3022739968","doi":"10.1007/978-3-030-47358-7_51","title":"Improving Classification Using Topic Correlation and Expectation Propagation","year":2020,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Latent Dirichlet allocation; Computer science; Dirichlet distribution; Topic model; Probabilistic logic; Artificial intelligence; Inference; Marginal distribution; Independence (probability theory); Machine learning; Mathematics; Statistics; Random variable","score_opus":0.056294409750157016,"score_gpt":0.3279848024457549,"score_spread":0.27169039269559786,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3022739968","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024653362,0.002425287,0.96434426,0.0006733318,0.00047321632,0.00012222254,0.0004533792,0.0049620774,0.0018929142],"genre_scores_gemma":[0.33443752,0.0021567792,0.6362099,0.0009391373,0.0021884192,0.00044475278,0.0067085666,0.0016205064,0.0152944],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.996128,0.0012642237,0.0002686815,0.0010064766,0.0009269198,0.00040560757],"domain_scores_gemma":[0.9896988,0.0068489467,0.0004344478,0.0011145159,0.0016339041,0.00026936043],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005254453,0.002620076,0.0034758565,0.0041717277,0.00148441,0.0030987125,0.003545575,0.0036252476,0.0039085625],"category_scores_gemma":[0.010766483,0.0010009091,0.0032633084,0.0054782922,0.00083520054,0.005576878,0.0030646592,0.0043821824,0.0049167215],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078664493,0.0005770314,0.0036358053,0.00033161356,0.0005264699,0.00013553491,0.00026616766,0.05281083,0.011961758,0.005649009,0.029709803,0.8936093],"study_design_scores_gemma":[0.000052164243,0.00010728313,0.001001461,0.00002447077,0.0001893881,0.00010049745,0.000056781653,0.979736,0.005431359,0.010823331,0.002447713,0.000029601219],"about_ca_topic_score_codex":0.0056491653,"about_ca_topic_score_gemma":0.008419906,"teacher_disagreement_score":0.0056491653,"about_ca_system_score_codex":0.0010201519,"about_ca_system_score_gemma":0.0019312524,"threshold_uncertainty_score":0.02778852},"labels":[],"label_agreement":null},{"id":"W3034470301","doi":"10.1016/j.forsciint.2020.110364","title":"Social media forensics applied to assessment of post–critical incident social reaction: The case of the 2017 Manchester Arena terrorist attack","year":2020,"lang":"en","type":"article","venue":"Forensic Science International","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Université du Québec à Trois-Rivières","funders":"Economic and Social Research Council","keywords":"Latent Dirichlet allocation; Social media; Law enforcement; Terrorism; Computer science; Data science; Topic model; Set (abstract data type); Event (particle physics); Computational sociology; Perception; Digital forensics; Computer security; Internet privacy; World Wide Web; Artificial intelligence; Political science; Law; Psychology","score_opus":0.1042927051340976,"score_gpt":0.4482298001236109,"score_spread":0.3439370949895133,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3034470301","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.88631237,0.0011820099,0.04648968,0.009278778,0.00069057965,0.0007172949,0.0012752827,0.00044628375,0.053607758],"genre_scores_gemma":[0.96608615,0.000694936,0.026988944,0.00025484842,0.00022905372,0.00011310599,0.00032135952,0.00004468463,0.0052669398],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9978282,0.0010457741,0.00013215834,0.00018890969,0.0005904489,0.00021447508],"domain_scores_gemma":[0.9898168,0.006046783,0.0011790328,0.0006368366,0.0019463954,0.00037413347],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003593775,0.0005607992,0.00025244462,0.00544313,0.0019070912,0.0033165216,0.0010000217,0.00196355,0.0031963107],"category_scores_gemma":[0.017481975,0.00023474763,0.00029166968,0.0021477707,0.0013246957,0.0023617765,0.0021880162,0.0012632904,0.0009152187],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012984814,0.0011020794,0.17976773,0.0014519396,0.000254433,0.027290167,0.062988594,0.021567069,0.028620513,0.06156319,0.037162546,0.5769332],"study_design_scores_gemma":[0.00011541283,0.0006719412,0.21251735,0.0025233133,0.00030349565,0.010166194,0.16343972,0.3857413,0.034291904,0.06669198,0.123155735,0.0003815748],"about_ca_topic_score_codex":0.0062618623,"about_ca_topic_score_gemma":0.009369467,"teacher_disagreement_score":0.0062618623,"about_ca_system_score_codex":0.00094047014,"about_ca_system_score_gemma":0.0015075146,"threshold_uncertainty_score":0.019005895},"labels":[],"label_agreement":null},{"id":"W3038101076","doi":"10.1162/qss_a_00055","title":"Beyond networks: Aligning qualitative and computational science studies","year":2020,"lang":"en","type":"article","venue":"Quantitative Science Studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Bridge (graph theory); Computer science; Dichotomy; Data science; Workflow; Domain (mathematical analysis); Epistemology; Point (geometry); Management science; Sociology; Cognitive science; Psychology; Engineering","score_opus":0.3028395154045068,"score_gpt":0.5582822649915379,"score_spread":0.25544274958703106,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3038101076","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1091286,0.019890651,0.6963977,0.077245295,0.0016463291,0.001040179,0.0010195039,0.00032596028,0.093305685],"genre_scores_gemma":[0.8532441,0.0072319712,0.12949643,0.003491564,0.0005668319,0.002734095,0.00039456194,0.00027605347,0.002564356],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8893616,0.09614995,0.0025983034,0.0033633986,0.0072776796,0.0012490328],"domain_scores_gemma":[0.6487746,0.32163748,0.008481227,0.010116873,0.009199488,0.0017902198],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.1206099,0.00094882696,0.0012104386,0.017796487,0.0047826134,0.017972672,0.0032151102,0.0022887788,0.003888582],"category_scores_gemma":[0.17297174,0.00067714456,0.0005428836,0.017068166,0.030409615,0.031910166,0.012167414,0.0033843461,0.00046807213],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005357929,0.000076115735,0.0045413803,0.0016231217,0.00006480739,0.00023319728,0.14803827,0.0017070902,0.00045647798,0.78932875,0.0023863784,0.05149086],"study_design_scores_gemma":[0.000021314925,0.00005217734,0.0022752471,0.0027475108,0.000027158248,0.0001219079,0.17563146,0.005877959,0.0005552144,0.7452935,0.0673525,0.000044026856],"about_ca_topic_score_codex":0.004127256,"about_ca_topic_score_gemma":0.0053656725,"teacher_disagreement_score":0.9822035,"about_ca_system_score_codex":0.010963931,"about_ca_system_score_gemma":0.009444231,"threshold_uncertainty_score":0.63785374},"labels":[],"label_agreement":null},{"id":"W3041672764","doi":"10.22215/etd/2018-12846","title":"Approach to Identify Topics in a Collection of TIM Review Articles and their Changes Over Time","year":2018,"lang":"en","type":"dissertation","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Latent Dirichlet allocation; Topic model; Strengths and weaknesses; Data science; Computer science; Information retrieval; Replicate; Psychology; Statistics; Mathematics","score_opus":0.057934491110195496,"score_gpt":0.4108684704531457,"score_spread":0.3529339793429502,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3041672764","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.085233666,0.009307036,0.8330137,0.005397012,0.0008951256,0.02449526,0.024371002,0.0049600326,0.012327144],"genre_scores_gemma":[0.11867088,0.001873091,0.8378665,0.00046969057,0.0003820572,0.025594022,0.009803977,0.0002410103,0.0050986693],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98417366,0.005016466,0.0028373783,0.0030180686,0.0045968355,0.00035770843],"domain_scores_gemma":[0.9607345,0.017221536,0.0061789076,0.0020195486,0.013180356,0.0006651284],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.018879982,0.0011807143,0.0012430655,0.034400575,0.0018865472,0.0054343916,0.0015565576,0.0012765938,0.0039853766],"category_scores_gemma":[0.04712421,0.0006438724,0.002645427,0.022797382,0.0009358234,0.003162225,0.0023467666,0.0015516705,0.003344898],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006153803,0.00040975085,0.040944833,0.008155264,0.0012298635,0.00056189054,0.008775815,0.0033062836,0.027797965,0.01236217,0.027361268,0.8684795],"study_design_scores_gemma":[0.00087446877,0.0017272979,0.21341628,0.003510072,0.00378147,0.0039051473,0.023442404,0.13966614,0.045857348,0.0866776,0.47605732,0.0010844048],"about_ca_topic_score_codex":0.0040245783,"about_ca_topic_score_gemma":0.00904972,"teacher_disagreement_score":0.9655994,"about_ca_system_score_codex":0.0030076255,"about_ca_system_score_gemma":0.007212266,"threshold_uncertainty_score":0.09984809},"labels":[],"label_agreement":null},{"id":"W3049266988","doi":"10.1007/978-3-030-53713-5_2","title":"Media Polls: The Gallup Legacy","year":2020,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Polling; Narrative; Opinion poll; Political science; Public opinion; Field (mathematics); Public relations; George (robot); Media studies; Sociology; Positive economics; History; Law; Economics; Politics; Computer science; Art","score_opus":0.08393230427908163,"score_gpt":0.34689173770476084,"score_spread":0.2629594334256792,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3049266988","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014479443,0.025709644,0.046902996,0.043828774,0.023309153,0.00024902818,0.0121843405,0.008745156,0.8376229],"genre_scores_gemma":[0.007944732,0.009518458,0.015817907,0.007267911,0.0070273145,0.00030297693,0.0067792335,0.007955847,0.9373857],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99704105,0.00078535447,0.00014385841,0.0003120554,0.0015254186,0.00019234967],"domain_scores_gemma":[0.98903906,0.0063360147,0.00024600571,0.0015872072,0.0022727922,0.0005188446],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005927202,0.0010226181,0.00086735265,0.008676675,0.0031767902,0.013135956,0.002012223,0.0022191796,0.14722632],"category_scores_gemma":[0.019534402,0.0009664891,0.0008226568,0.008259126,0.0019436779,0.011095947,0.0039946605,0.002855942,0.100441344],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021260921,0.000015708309,0.00011285525,0.00012333538,0.000008043412,0.000015111431,0.0003828788,0.000089661764,0.00010098879,0.042586263,0.7774543,0.17908949],"study_design_scores_gemma":[0.000002230651,0.0000017596884,0.0001259298,0.000113491005,0.0000027511837,0.000015625288,0.00009874319,0.00011908567,0.00010155053,0.009009872,0.9904019,0.0000070556152],"about_ca_topic_score_codex":0.011843233,"about_ca_topic_score_gemma":0.022550354,"teacher_disagreement_score":0.14722632,"about_ca_system_score_codex":0.002253577,"about_ca_system_score_gemma":0.0034777366,"threshold_uncertainty_score":0.4925211},"labels":[],"label_agreement":null},{"id":"W3083539572","doi":"10.4000/tvseries.4296","title":"Les séries télévisées médicales étatsuniennes : évolutions, permanences et enjeux de l’« asymétrie réaliste »","year":2020,"lang":"fr","type":"article","venue":"TV/Series","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Musée de la Civilisation","funders":"","keywords":"Humanities; Political science; Philosophy","score_opus":0.14288670828011416,"score_gpt":0.3984747264374298,"score_spread":0.2555880181573157,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3083539572","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.60939693,0.018828537,0.019782918,0.021691315,0.0030873276,0.00029104418,0.00317454,0.00028746692,0.32345995],"genre_scores_gemma":[0.91900444,0.008609296,0.010115774,0.0009639569,0.0012017643,0.00037222297,0.0012928626,0.0002623543,0.058177404],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.99601066,0.0017246485,0.0002613631,0.0006191074,0.0011769647,0.0002071936],"domain_scores_gemma":[0.9813519,0.013404248,0.0022019527,0.0010847945,0.0013444757,0.0006125627],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0045383475,0.00040063742,0.00035126827,0.0060234703,0.003599826,0.005758207,0.0008704338,0.0009727441,0.01584334],"category_scores_gemma":[0.019692844,0.00021823165,0.00028572898,0.008372306,0.0075486554,0.0055901445,0.0030556952,0.001576555,0.0010965191],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002572279,0.000053469645,0.020669742,0.0014776662,0.00005040855,0.00076992717,0.3885484,0.0005563715,0.0033314396,0.36877504,0.017054,0.19845635],"study_design_scores_gemma":[0.00002581552,0.00011248765,0.050948974,0.0014954521,0.00004096079,0.0010368242,0.13700627,0.0007112477,0.0022414043,0.03278877,0.77352506,0.000066682136],"about_ca_topic_score_codex":0.011458989,"about_ca_topic_score_gemma":0.018456472,"teacher_disagreement_score":0.01584334,"about_ca_system_score_codex":0.006728816,"about_ca_system_score_gemma":0.004381775,"threshold_uncertainty_score":0.053001225},"labels":[],"label_agreement":null},{"id":"W3085739551","doi":"","title":"Development of Concert Model by Integrating Classic Music and Puppet Show and Its Effect on Story Comprehension and Leit Motif Recognition","year":2009,"lang":"en","type":"article","venue":"Early childhood education","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Motif (music); Comprehension; Cognitive psychology; Psychology; Communication; Cognitive science; Linguistics; Art; Aesthetics; Philosophy","score_opus":0.03278130423566612,"score_gpt":0.3111879186897638,"score_spread":0.2784066144540977,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3085739551","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9514174,0.0001030137,0.04165319,0.00007197403,0.000024675754,0.000075420074,0.00026977225,0.0014744435,0.0049100514],"genre_scores_gemma":[0.95795786,0.0000827585,0.03814061,0.000021310056,0.000004537506,0.0000681507,0.00063112314,0.00015005378,0.0029435265],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9998578,0.000033119388,0.00000649314,0.0000584571,0.000027421112,0.00001673679],"domain_scores_gemma":[0.9994205,0.0002492645,0.000052573116,0.0000912387,0.00008386639,0.00010262597],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00027784175,0.00042888758,0.00026183657,0.00036744503,0.000225059,0.0006282045,0.00053871423,0.00035655606,0.007566828],"category_scores_gemma":[0.0017285042,0.00020836292,0.00035971453,0.00020016666,0.0002168786,0.0009974175,0.00041913276,0.00036591708,0.0008553548],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00281941,0.002709224,0.034064796,0.00041081742,0.00016547598,0.000559122,0.0015513848,0.013481149,0.60663056,0.004786344,0.0029409803,0.3298808],"study_design_scores_gemma":[0.00029155807,0.0034438944,0.11886554,0.000053656655,0.00083200575,0.000989174,0.0021975352,0.47892013,0.37848917,0.004147624,0.011643172,0.0001264564],"about_ca_topic_score_codex":0.0022541883,"about_ca_topic_score_gemma":0.0022090846,"teacher_disagreement_score":0.007566828,"about_ca_system_score_codex":0.00018994584,"about_ca_system_score_gemma":0.0003151943,"threshold_uncertainty_score":0.025313616},"labels":[],"label_agreement":null},{"id":"W3091863897","doi":"10.1007/978-3-030-55944-1_7","title":"Epilogue on Methodology","year":2020,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; Memorial University of Newfoundland","funders":"","keywords":"Dichotomy; Pragmatism; Corporate governance; Politics; Management science; Sociology; Environmental governance; Process (computing); Epistemology; Political science; Computer science; Engineering; Business","score_opus":0.3624885282656504,"score_gpt":0.44425613030606,"score_spread":0.08176760204040956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3091863897","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00046652945,0.0186898,0.083272,0.1481549,0.15369168,0.00061040046,0.0030133345,0.0021758429,0.5899255],"genre_scores_gemma":[0.0070767,0.0110144615,0.026210051,0.07475937,0.048024084,0.0010453853,0.0017554221,0.0033630223,0.8267515],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.995704,0.0018337626,0.00017419836,0.00042710017,0.0016398425,0.0002210705],"domain_scores_gemma":[0.98421013,0.0088805575,0.00027963004,0.0014499644,0.004530746,0.0006490696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0075404583,0.0012435818,0.0009904451,0.0041080583,0.00209621,0.006561076,0.0020245065,0.002893726,0.21420246],"category_scores_gemma":[0.02780456,0.00057518104,0.00083651347,0.0026191855,0.0035976393,0.0069618933,0.0033993348,0.0065100803,0.09643808],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000305576,0.00002282501,0.000046047495,0.00022621191,0.0000043013406,0.00003387131,0.000115522416,0.000075132375,0.00013112895,0.18509854,0.76102465,0.053191222],"study_design_scores_gemma":[0.0000063588805,0.000009591217,0.000060177375,0.00013074352,0.0000019718666,0.00004203178,0.00005433795,0.00007267311,0.000076642384,0.044232957,0.95530665,0.000005934187],"about_ca_topic_score_codex":0.002811626,"about_ca_topic_score_gemma":0.0034827455,"teacher_disagreement_score":0.21420246,"about_ca_system_score_codex":0.0023717068,"about_ca_system_score_gemma":0.00396831,"threshold_uncertainty_score":0.7165786},"labels":[],"label_agreement":null},{"id":"W3094599270","doi":"","title":"LibGuides: Government Publications - Canada: Google Canadian Government Documents","year":2009,"lang":"en","type":"libguides","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Government (linguistics); World Wide Web; Library science; Political science; Business; Computer science","score_opus":0.026411265714068054,"score_gpt":0.3118988430651922,"score_spread":0.2854875773511242,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3094599270","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017985017,0.0037206607,0.0060464004,0.0018553764,0.00042404482,0.0001515359,0.58275187,0.040473904,0.3627777],"genre_scores_gemma":[0.01392545,0.008492129,0.018828228,0.00045055096,0.00025356765,0.00031807087,0.52759445,0.0295788,0.40055874],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987908,0.000057568668,0.00006894326,0.00013932768,0.00078290736,0.00016050565],"domain_scores_gemma":[0.99488467,0.00059117336,0.00016476386,0.0005005867,0.0034805993,0.00037820553],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0008845975,0.002085239,0.0013592668,0.013716648,0.0032706857,0.008345421,0.0028966789,0.0012696541,0.32930332],"category_scores_gemma":[0.008373336,0.0011745514,0.00078873965,0.04091334,0.0011465898,0.0053609186,0.0022960552,0.0019752814,0.2356553],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002079034,0.000009870717,0.00024508985,0.00019178411,0.00000638019,0.000024446925,0.00008783079,0.00011627503,0.000082840466,0.0033339034,0.94911253,0.046768356],"study_design_scores_gemma":[0.000014934024,0.0000024393728,0.0012220168,0.0002392805,0.000013074199,0.0000598848,0.00020707982,0.00057798385,0.00064382405,0.003336039,0.9936511,0.00003227374],"about_ca_topic_score_codex":0.7695832,"about_ca_topic_score_gemma":0.79849344,"teacher_disagreement_score":0.32930332,"about_ca_system_score_codex":0.010186755,"about_ca_system_score_gemma":0.02974689,"threshold_uncertainty_score":0.9566674},"labels":[],"label_agreement":null},{"id":"W3107782320","doi":"10.7202/1072923ar","title":"Margaret Low (1941-2020)","year":2020,"lang":"fr","type":"article","venue":"Rabaska Revue d ethnologie de l Amérique française","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"History; Political science","score_opus":0.04773993672471009,"score_gpt":0.3136075392169498,"score_spread":0.2658676024922397,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3107782320","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015287243,0.22353682,0.0011313614,0.5097698,0.16452464,0.000038832673,0.0010891283,0.00023237162,0.09814825],"genre_scores_gemma":[0.015557666,0.04054968,0.00077588257,0.050189406,0.0154447695,0.000055318997,0.00040081757,0.0001949462,0.87683153],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9988808,0.00018598438,0.000036605143,0.0002696705,0.0004968659,0.00013006816],"domain_scores_gemma":[0.99775726,0.00026246815,0.000106933105,0.000051078972,0.00092894235,0.0008933756],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016024718,0.0006134102,0.00038586473,0.0021533063,0.002035651,0.002435414,0.00056027377,0.0020215337,0.060363676],"category_scores_gemma":[0.0067091202,0.00026324284,0.00022772171,0.001179397,0.00076520693,0.0020147562,0.0025027571,0.0025800674,0.032213926],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000013592423,0.0000042282645,0.00022154514,0.000050568775,0.0000017645001,0.00003429567,0.00009168392,0.000012070319,0.000056741057,0.0023419387,0.9573764,0.039795186],"study_design_scores_gemma":[0.0000011073212,0.0000033348747,0.00034003946,0.00006285939,9.730912e-7,0.000037985006,0.00006588989,0.000007954166,0.00004636769,0.00042094316,0.9990096,0.000002924676],"about_ca_topic_score_codex":0.019394461,"about_ca_topic_score_gemma":0.04371042,"teacher_disagreement_score":0.060363676,"about_ca_system_score_codex":0.0041235257,"about_ca_system_score_gemma":0.0037501242,"threshold_uncertainty_score":0.2019366},"labels":[],"label_agreement":null},{"id":"W3108885890","doi":"","title":"An Empirical Text Mining Analysis of Fort McMurray Wildfire Disaster Twitter Communication using Topic Model","year":2016,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Latent Dirichlet allocation; Topic model; Crisis communication; Emergency management; Computer science; Computer security; Geography; Natural language processing; Political science; Public relations","score_opus":0.0687438818837136,"score_gpt":0.42136891643842644,"score_spread":0.35262503455471284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3108885890","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9958055,0.00008709157,0.0013363201,0.00021383201,0.000009132843,0.00004225401,0.00175867,0.000025446816,0.00072172715],"genre_scores_gemma":[0.992392,0.0001148359,0.0021604083,0.000033168602,0.000027912498,0.000072948205,0.004103627,0.000012326975,0.0010828404],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99933124,0.00026131896,0.000054588007,0.000115296854,0.00015544819,0.00008217851],"domain_scores_gemma":[0.99178314,0.0058664577,0.00086107996,0.00033148017,0.0009183999,0.00023942588],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012787319,0.00025162735,0.00029901537,0.0022808448,0.00075159065,0.00093758665,0.0004965558,0.00053042633,0.0012376999],"category_scores_gemma":[0.008300194,0.00014484151,0.00035027743,0.0032274001,0.00035973752,0.0008275026,0.00039861264,0.00061969215,0.00067973114],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009954262,0.001064783,0.8519134,0.0004546652,0.00022983854,0.0019172345,0.010930206,0.011469941,0.0073216856,0.0031181446,0.0126726655,0.09791205],"study_design_scores_gemma":[0.000030320336,0.00034348518,0.8117318,0.000096076314,0.00011251157,0.00088830775,0.011147035,0.16180153,0.0038442055,0.0013809542,0.008554716,0.00006896716],"about_ca_topic_score_codex":0.017699178,"about_ca_topic_score_gemma":0.020302309,"teacher_disagreement_score":0.9823008,"about_ca_system_score_codex":0.0008621263,"about_ca_system_score_gemma":0.0005658053,"threshold_uncertainty_score":0.03519231},"labels":[],"label_agreement":null},{"id":"W3109343335","doi":"10.1016/j.neuroscience.2020.08.027","title":"Thomas M. Jessell (1951–2019)","year":2020,"lang":"en","type":"editorial","venue":"Neuroscience","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Montreal Clinical Research Institute","funders":"","keywords":"Psychology; Neuroscience","score_opus":0.043910693817703024,"score_gpt":0.39220096850526037,"score_spread":0.34829027468755736,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3109343335","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00001415421,0.017639965,0.00027377708,0.040169977,0.94004875,0.000008769,0.000068789,0.000042736956,0.0017330345],"genre_scores_gemma":[0.0006233183,0.022287967,0.0003225685,0.023683049,0.9291817,0.000026184958,0.00008263129,0.00013713776,0.023655338],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99506617,0.0007880686,0.0005567887,0.0007888081,0.00259516,0.00020496087],"domain_scores_gemma":[0.96680886,0.013732489,0.0015465531,0.00070664025,0.013861052,0.0033443002],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00915795,0.0026632927,0.0024672786,0.0067342394,0.0023688145,0.009595562,0.0026640757,0.0071360697,0.022772638],"category_scores_gemma":[0.045791794,0.00094181066,0.0015398785,0.0023292545,0.002853553,0.005088513,0.0022384396,0.013689922,0.025318036],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014373123,0.0000020006523,0.000011518947,0.00012874509,0.000009486348,0.000035837787,0.000011098112,0.00001628573,0.000022090584,0.00045288523,0.9918195,0.007476164],"study_design_scores_gemma":[0.000011820238,0.0000063539337,0.00007825821,0.00040257353,0.000017955925,0.00012565662,0.000018212651,0.00004615764,0.00006686589,0.0012346248,0.9979765,0.000015107994],"about_ca_topic_score_codex":0.0035275682,"about_ca_topic_score_gemma":0.008156499,"teacher_disagreement_score":0.022772638,"about_ca_system_score_codex":0.0035317843,"about_ca_system_score_gemma":0.0043770657,"threshold_uncertainty_score":0.07618207},"labels":[],"label_agreement":null},{"id":"W3111126926","doi":"10.1007/s11229-020-02915-6","title":"Eight journals over eight decades: a computational topic-modeling approach to contemporary philosophy of science","year":2020,"lang":"en","type":"article","venue":"Synthese","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":20,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Canada Research Chairs; Canada Foundation for Innovation","keywords":"Philosophy of science; Philosophy of language; Philosophy of computer science; Epistemology; History and philosophy of science; Empiricism; Philosophy of biology; Field (mathematics); Object (grammar); Western philosophy; Metaphysics; Social science; Sociology; Philosophy; Mathematics; Linguistics","score_opus":0.17967260698535828,"score_gpt":0.40149572600388855,"score_spread":0.22182311901853027,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3111126926","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.31110355,0.13697173,0.16541755,0.1550625,0.005089028,0.0004998985,0.00752263,0.0012468771,0.21708629],"genre_scores_gemma":[0.8881558,0.031627852,0.059905905,0.003500312,0.0029487167,0.00049365096,0.0025562337,0.00031948794,0.010491948],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99453074,0.0029641502,0.00045838585,0.0007490962,0.0011045272,0.00019323268],"domain_scores_gemma":[0.92428243,0.061902918,0.0055024605,0.0018603358,0.0046467455,0.0018050952],"candidate_categories":["metaresearch","bibliometrics","sts"],"consensus_categories":[],"category_scores_codex":[0.012801999,0.00045003215,0.0006472298,0.023233797,0.0029037998,0.010821746,0.001263386,0.0021070864,0.008134044],"category_scores_gemma":[0.043159977,0.00044762978,0.000615951,0.03159397,0.0033921346,0.012991281,0.0024413224,0.0020749122,0.0007943144],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023094767,0.00013757964,0.01956108,0.0025345066,0.00032930766,0.0003446424,0.04401905,0.0028195973,0.0010103631,0.6401717,0.027709065,0.26113218],"study_design_scores_gemma":[0.000101965314,0.00012650204,0.02530216,0.0038399464,0.0004455765,0.00035642754,0.030236166,0.012783875,0.0011994353,0.5500785,0.37543848,0.00009099192],"about_ca_topic_score_codex":0.0024300017,"about_ca_topic_score_gemma":0.0036261,"teacher_disagreement_score":0.9970962,"about_ca_system_score_codex":0.0036616689,"about_ca_system_score_gemma":0.00654312,"threshold_uncertainty_score":0.06770426},"labels":[{"model":"gemma","categories":["bibliometrics","sts"],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["bibliometrics"],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W3112499565","doi":"10.4000/dms.5873","title":"Collecter et gérer les données : réflexions à l’heure du big data","year":2020,"lang":"fr","type":"article","venue":"Distances et médiations des savoirs","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Humanities; Philosophy","score_opus":0.296342278939102,"score_gpt":0.3812530099621883,"score_spread":0.08491073102308633,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3112499565","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041986812,0.077266395,0.3518673,0.48216,0.0041337246,0.0007963355,0.0058130533,0.0010036974,0.034972753],"genre_scores_gemma":[0.49607515,0.05408387,0.3789635,0.036244642,0.0039975494,0.0027212424,0.003160531,0.0021106142,0.022642935],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7668776,0.17669173,0.00640248,0.011415537,0.036126696,0.0024859796],"domain_scores_gemma":[0.37303314,0.5191954,0.009547383,0.046681944,0.047197253,0.004344922],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.23907909,0.0019231534,0.003273986,0.01637337,0.009113107,0.03465417,0.0062093874,0.004286944,0.006725799],"category_scores_gemma":[0.41943446,0.0023401368,0.003057738,0.026279634,0.036343217,0.036511526,0.016254684,0.013098101,0.0015451935],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003010268,0.000113082875,0.014966425,0.0053224564,0.0011239719,0.0004023772,0.119996056,0.0027855206,0.0013707734,0.56132615,0.05523693,0.23705535],"study_design_scores_gemma":[0.00014843278,0.00010586204,0.019449672,0.009560766,0.00045180658,0.0003941795,0.07489664,0.006688907,0.0033218132,0.3825904,0.5019921,0.00039938773],"about_ca_topic_score_codex":0.23220888,"about_ca_topic_score_gemma":0.2703509,"teacher_disagreement_score":0.23907909,"about_ca_system_score_codex":0.031292796,"about_ca_system_score_gemma":0.048649088,"threshold_uncertainty_score":0.938351},"labels":[],"label_agreement":null},{"id":"W3112544537","doi":"10.12758/mda.2020.10","title":"Coding Text Answers to Open-ended Questions: Human Coders and Statistical Learning Algorithms Make Similar Mistakes","year":2021,"lang":"en","type":"article","venue":"Social Science Open Access Repository (GESIS – Leibniz Institute for the Social Sciences)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Statistical model; Coding (social sciences); Computer science; Statistical learning; Natural language processing; Artificial intelligence; Statistical analysis; Correlation; Speech recognition; Machine learning; Statistics; Mathematics","score_opus":0.15832143950067812,"score_gpt":0.5040170616981421,"score_spread":0.34569562219746397,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3112544537","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5628943,0.0010147543,0.4116781,0.0028908735,0.00074236904,0.002716201,0.002198795,0.0020595232,0.013805098],"genre_scores_gemma":[0.87839305,0.00036888447,0.10947392,0.0025506853,0.00015861682,0.0026152327,0.0024315075,0.00068304973,0.0033250605],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.7541195,0.15729167,0.018014163,0.01948674,0.048658114,0.0024299005],"domain_scores_gemma":[0.27342936,0.5795603,0.05698637,0.04501395,0.04348148,0.0015285148],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.091627635,0.0016178773,0.0014930229,0.004963823,0.0017165828,0.0039985892,0.0023014413,0.002714322,0.0026633192],"category_scores_gemma":[0.5347641,0.0008634264,0.0010161884,0.0055215904,0.0049708295,0.00449371,0.004255906,0.0023193052,0.0015580796],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036363155,0.0011918199,0.24680665,0.0064588757,0.0031461497,0.0018588031,0.14885993,0.018365279,0.028297411,0.03594349,0.03786603,0.46756926],"study_design_scores_gemma":[0.0009740108,0.001480737,0.33323184,0.0057625826,0.0011436669,0.0040097316,0.06132422,0.1705151,0.06432169,0.26205593,0.093779966,0.0014005667],"about_ca_topic_score_codex":0.00259075,"about_ca_topic_score_gemma":0.00246923,"teacher_disagreement_score":0.90837234,"about_ca_system_score_codex":0.002683436,"about_ca_system_score_gemma":0.0022527871,"threshold_uncertainty_score":0.48457903},"labels":[],"label_agreement":null},{"id":"W3113091126","doi":"10.1016/j.bdr.2020.100173","title":"Agreeing to Disagree: Choosing Among Eight Topic-Modeling Methods","year":2020,"lang":"en","type":"article","venue":"Big Data Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":31,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University; University of British Columbia","funders":"Hong Kong Polytechnic University","keywords":"Latent Dirichlet allocation; Topic model; Computer science; Data science; Artificial intelligence; Coherence (philosophical gambling strategy); Field (mathematics); Context (archaeology); Machine learning; Management science; Natural language processing","score_opus":0.8645336607084751,"score_gpt":0.6295130273678069,"score_spread":0.23502063334066825,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3113091126","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20817952,0.004004317,0.7457227,0.012382163,0.0011313291,0.006634318,0.0013166703,0.0019109832,0.018717991],"genre_scores_gemma":[0.44020402,0.0010317698,0.54505825,0.0017974864,0.0004251892,0.0070835035,0.001521211,0.0005649134,0.0023136889],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8347772,0.13813059,0.007954801,0.0059450897,0.010915814,0.0022765908],"domain_scores_gemma":[0.37746418,0.5812154,0.008933019,0.01187027,0.015624114,0.0048930957],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.19767164,0.002535491,0.0030236938,0.006498765,0.004347725,0.007980894,0.005831443,0.005154657,0.0068139927],"category_scores_gemma":[0.33299738,0.0016353521,0.004478248,0.0047674426,0.0035444514,0.011113788,0.007425272,0.007263245,0.002170931],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012062685,0.0023744374,0.08158297,0.0047647594,0.0042136568,0.00023746447,0.024655268,0.008747776,0.0036441304,0.042182613,0.024208115,0.7913261],"study_design_scores_gemma":[0.0068824044,0.0026457645,0.049228467,0.0049787834,0.0062374845,0.00083550107,0.0321158,0.4033126,0.013307264,0.43766236,0.041523848,0.0012697695],"about_ca_topic_score_codex":0.0013659702,"about_ca_topic_score_gemma":0.004318592,"teacher_disagreement_score":0.19767164,"about_ca_system_score_codex":0.0017502378,"about_ca_system_score_gemma":0.0038891658,"threshold_uncertainty_score":0.98941374},"labels":[],"label_agreement":null},{"id":"W3121876164","doi":"10.1007/s11606-020-06579-3","title":"The Gender of COVID-19 Experts in Newspaper Articles: a Descriptive Cross-Sectional Study","year":2021,"lang":"en","type":"article","venue":"Journal of General Internal Medicine","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":20,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; University of Calgary; University of British Columbia","funders":"Cumming School of Medicine, University of Calgary","keywords":"Newspaper; Medicine; Pandemic; Cross-sectional study; Confidence interval; Coronavirus disease 2019 (COVID-19); Family medicine; Media studies; Sociology; Pathology; Disease; Internal medicine","score_opus":0.1685033957827846,"score_gpt":0.4774958725633728,"score_spread":0.30899247678058817,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3121876164","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99818474,0.00011890327,0.000042352058,0.00008175735,0.000015561889,0.000021920723,0.00053410785,0.0000017875966,0.0009988821],"genre_scores_gemma":[0.99767345,0.0001258732,0.00008248646,0.0001355073,0.000038549915,0.000048550843,0.00055250106,0.0000068578,0.0013361424],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9982339,0.0004349872,0.00028556935,0.00029002162,0.000462994,0.0002924184],"domain_scores_gemma":[0.9892803,0.003409711,0.0044338065,0.00040900242,0.0013657013,0.0011015892],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0016091841,0.00025804035,0.0004225157,0.0023815879,0.0009854542,0.0019082178,0.00044512103,0.001033149,0.0066958377],"category_scores_gemma":[0.009806242,0.0004948876,0.00043600926,0.0019487166,0.00049773604,0.0016437811,0.0009106741,0.0009604293,0.0014786152],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013085929,0.0002933482,0.99408984,0.000029379853,0.00003821819,0.00012126826,0.003278632,0.000006486823,0.00033759017,0.00003900626,0.00028664598,0.0013486085],"study_design_scores_gemma":[0.000004299531,0.000119219476,0.9904535,0.000018440322,0.000015545807,0.00020094214,0.00866833,0.000034541164,0.000057578465,0.00002441774,0.00039611972,0.0000070859846],"about_ca_topic_score_codex":0.002636098,"about_ca_topic_score_gemma":0.0049888906,"teacher_disagreement_score":0.99761844,"about_ca_system_score_codex":0.00044732692,"about_ca_system_score_gemma":0.00043240987,"threshold_uncertainty_score":0.022399783},"labels":[],"label_agreement":null},{"id":"W3123461482","doi":"10.3233/978-1-61499-726-9-119","title":"Can Robots Write Treaties? Using Recurrent Neural Networks to Draft International Investment Agreements","year":2016,"lang":"en","type":"book-chapter","venue":"Frontiers in artificial intelligence and applications","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Artificial neural network; International investment; Robot; Hull; Investment (military); Computer science; Business; International trade; Artificial intelligence; Political science; Engineering; Marine engineering; Law; Foreign direct investment","score_opus":0.09311296975880853,"score_gpt":0.3711962624853107,"score_spread":0.2780832927265021,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3123461482","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08241997,0.0017916119,0.83984953,0.0048075574,0.000500157,0.00012871102,0.0007852816,0.013474665,0.056242436],"genre_scores_gemma":[0.48675963,0.0018940351,0.45462224,0.0006572163,0.00019704693,0.00014676047,0.0021056477,0.0009812467,0.05263619],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9996817,0.00013716433,0.00001720153,0.00008404229,0.000061032024,0.000018921033],"domain_scores_gemma":[0.9993049,0.0004474001,0.000076163225,0.00008465118,0.00006684898,0.000020044847],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008344842,0.0006633865,0.00022660542,0.00028724052,0.00031137012,0.0011793425,0.0006960535,0.00092052587,0.008184666],"category_scores_gemma":[0.0054637007,0.00033048433,0.00042557088,0.00033036966,0.000563075,0.0025404876,0.00058062054,0.0013665986,0.004425255],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019772965,0.00008291432,0.0025417665,0.00037535917,0.0000742416,0.00024375966,0.0013858423,0.110813424,0.017128034,0.04195307,0.03480637,0.7903974],"study_design_scores_gemma":[0.000032409764,0.00009690803,0.002038835,0.00017989265,0.000031623655,0.00016903091,0.0005052092,0.8219359,0.019306317,0.07928009,0.07637034,0.00005338434],"about_ca_topic_score_codex":0.0022900803,"about_ca_topic_score_gemma":0.005035772,"teacher_disagreement_score":0.008184666,"about_ca_system_score_codex":0.0006230319,"about_ca_system_score_gemma":0.00036607496,"threshold_uncertainty_score":0.027380466},"labels":[],"label_agreement":null},{"id":"W3125757955","doi":"10.7202/1074188ar","title":"Un modèle continu, non linéaire et collaboratif de l’enquête","year":2020,"lang":"fr","type":"article","venue":"Criminologie","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"International Centre for Comparative Criminology; Université de Montréal; Université du Québec à Trois-Rivières; Université du Québec à Montréal","funders":"","keywords":"Humanities; Political science; Philosophy","score_opus":0.41108401288030727,"score_gpt":0.43662012585302906,"score_spread":0.02553611297272179,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3125757955","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.054442234,0.0010320046,0.7789361,0.0069083846,0.0002817566,0.00063073385,0.0005404933,0.0007092052,0.15651907],"genre_scores_gemma":[0.5988056,0.0009735942,0.33752367,0.0005103707,0.00013359761,0.0013543121,0.0008824896,0.0003212901,0.059494965],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9907188,0.0045011234,0.00047950234,0.002062427,0.0017023253,0.00053580804],"domain_scores_gemma":[0.9853925,0.007422694,0.0013666024,0.0021926006,0.0025481323,0.0010774268],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006927518,0.0012301713,0.00079484854,0.002989355,0.0036358088,0.009869967,0.0038758658,0.0038370392,0.019200515],"category_scores_gemma":[0.02062655,0.0011921966,0.002193836,0.0023230729,0.0076021166,0.012075597,0.005590362,0.0029865594,0.0037366198],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013322984,0.00015734494,0.005551363,0.00029877623,0.000078820005,0.0004467267,0.020193597,0.020907113,0.0010350064,0.9160537,0.0029023178,0.032242004],"study_design_scores_gemma":[0.00017610256,0.0003057128,0.004754187,0.0006615227,0.00018689522,0.00085985335,0.01340782,0.16634351,0.0016852798,0.6383338,0.17309211,0.00019320344],"about_ca_topic_score_codex":0.016286213,"about_ca_topic_score_gemma":0.011028217,"teacher_disagreement_score":0.019200515,"about_ca_system_score_codex":0.0051089716,"about_ca_system_score_gemma":0.007820195,"threshold_uncertainty_score":0.06423211},"labels":[],"label_agreement":null},{"id":"W3127870579","doi":"10.22215/timreview/1415","title":"A Roadmap for Systematically Identifying Opportunities in Ecosystems Using Scientific Publications Data","year":2021,"lang":"en","type":"article","venue":"Technology Innovation Management Review","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Ecosystem; Business; Regional science; Knowledge management; Political science; Computer science; Geography; Ecology; Biology","score_opus":0.5379690832792727,"score_gpt":0.5076537826015161,"score_spread":0.030315300677756674,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3127870579","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021018874,0.057160154,0.5555904,0.05611242,0.0032979238,0.016042178,0.24505997,0.015004001,0.03071407],"genre_scores_gemma":[0.037011836,0.014427675,0.83342385,0.002248469,0.00056913233,0.012516972,0.096924454,0.00051160983,0.0023659363],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9591802,0.021383258,0.008015725,0.0042259605,0.0064002103,0.0007946897],"domain_scores_gemma":[0.6196684,0.23872328,0.026811099,0.03607237,0.07135469,0.0073701707],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.07548671,0.0029711952,0.0036921848,0.066380545,0.003277296,0.014828409,0.0045911474,0.0030939644,0.026363503],"category_scores_gemma":[0.23143715,0.0016668513,0.0065066665,0.049371988,0.0018453661,0.020102188,0.009594864,0.0041233674,0.01446362],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042613375,0.00037508243,0.051001456,0.050867226,0.002255602,0.00046564254,0.0021317664,0.004038605,0.0027034115,0.052282706,0.1328733,0.70057905],"study_design_scores_gemma":[0.00032954963,0.0004086818,0.04121173,0.06375769,0.003733715,0.0006472282,0.005549569,0.025466248,0.0041653197,0.30936432,0.54478186,0.00058403646],"about_ca_topic_score_codex":0.014031649,"about_ca_topic_score_gemma":0.019090822,"teacher_disagreement_score":0.93361944,"about_ca_system_score_codex":0.0039815153,"about_ca_system_score_gemma":0.031558152,"threshold_uncertainty_score":0.39921665},"labels":[],"label_agreement":null},{"id":"W3156250183","doi":"10.32609/0042-8736-2021-4-79-95","title":"Uses of content analysis in economic sciences: An overview of the current situation and prospects","year":2021,"lang":"en","type":"article","venue":"Voprosy Ekonomiki","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Content analysis; Qualitative analysis; Metadata; Content (measure theory); Qualitative research; Quantitative analysis (chemistry); Qualitative property; Data science; Set (abstract data type); Computer science; Economic analysis; Social science; Sociology; World Wide Web; Economics; Mathematics; Classical economics","score_opus":0.2642998295530717,"score_gpt":0.43803630584033865,"score_spread":0.17373647628726696,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3156250183","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022616962,0.92439896,0.015644535,0.03836929,0.0016987149,0.000093909744,0.00012975336,0.00011599679,0.017287182],"genre_scores_gemma":[0.02249921,0.95619804,0.013552467,0.0029564803,0.0027875497,0.00022270803,0.00016875102,0.00010561237,0.0015091506],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.96734536,0.020561635,0.0024044993,0.0017289525,0.007143396,0.00081621663],"domain_scores_gemma":[0.8448344,0.13387515,0.004827945,0.0024135297,0.012220416,0.0018286301],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04427414,0.0012399099,0.0018222254,0.02809148,0.0028728298,0.015619149,0.002397219,0.0042021084,0.0045266584],"category_scores_gemma":[0.04315024,0.0008785416,0.0012277834,0.030882645,0.012606933,0.020859158,0.005213615,0.0038479392,0.0015225832],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000073380645,0.000092882394,0.004605664,0.016251927,0.0001054717,0.00026965063,0.0061887773,0.00086583674,0.0005745548,0.17108902,0.024809444,0.77507347],"study_design_scores_gemma":[0.000018211933,0.00013191749,0.011121808,0.051531628,0.00014381656,0.0018269888,0.01465419,0.0029370603,0.000874797,0.14182527,0.7747203,0.00021403523],"about_ca_topic_score_codex":0.0047519556,"about_ca_topic_score_gemma":0.003464209,"teacher_disagreement_score":0.95572585,"about_ca_system_score_codex":0.010366572,"about_ca_system_score_gemma":0.00959761,"threshold_uncertainty_score":0.23414683},"labels":[],"label_agreement":null},{"id":"W3157442534","doi":"","title":"Thierry Warin: [R Course] How to: Create Diagrams","year":2020,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Center for Interuniversity Research and Analysis on Organizations; HEC Montréal","funders":"","keywords":"Course (navigation); Computer science; Engineering","score_opus":0.08012695166398934,"score_gpt":0.38334896826270853,"score_spread":0.30322201659871917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3157442534","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007339776,0.00090031355,0.7625936,0.01735562,0.0044232737,0.0004834821,0.014844132,0.13054268,0.068122886],"genre_scores_gemma":[0.008862975,0.0016082764,0.6443182,0.006110494,0.0014888843,0.0012769222,0.0124828955,0.11470828,0.20914313],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.998609,0.00044327392,0.00009738986,0.00026518945,0.0005207937,0.00006440725],"domain_scores_gemma":[0.98385125,0.009777754,0.00036513215,0.0015240835,0.0038779199,0.00060392293],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002953635,0.0021678053,0.000931797,0.0023669007,0.0009205465,0.00246592,0.0019922403,0.0016220039,0.30947345],"category_scores_gemma":[0.041072376,0.0011408243,0.0013592746,0.0018914128,0.0008119359,0.00425047,0.0023113955,0.0030494828,0.30014926],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00001663917,0.000009678126,0.00010499242,0.00015012588,0.000010393655,0.000045122928,0.000106010324,0.0002980483,0.00062003545,0.00534132,0.9249518,0.068345964],"study_design_scores_gemma":[0.0000331928,0.000012067904,0.00018995666,0.00019721723,0.000019733003,0.00018745144,0.000078832934,0.0034979936,0.0025123912,0.019052396,0.9741665,0.00005221353],"about_ca_topic_score_codex":0.0047583375,"about_ca_topic_score_gemma":0.008408679,"teacher_disagreement_score":0.30947345,"about_ca_system_score_codex":0.0007453412,"about_ca_system_score_gemma":0.0016563872,"threshold_uncertainty_score":0.98495233},"labels":[],"label_agreement":null},{"id":"W3161329260","doi":"10.31234/osf.io/8mn6w","title":"Effects of Expert Ideology on Expert Personality Judgements of Political Figures: A Commentary","year":2019,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Burnaby Hospital","funders":"","keywords":"Ideology; Politics; Personality psychology; Personality; Objectivity (philosophy); Profiling (computer programming); Psychology; Social psychology; Political science; Sociology; Social science; Epistemology; Law; Computer science; Philosophy","score_opus":0.05214019105270495,"score_gpt":0.41935093336964213,"score_spread":0.3672107423169372,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3161329260","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009144954,0.017127175,0.00037295918,0.9136727,0.06400284,0.000026221729,0.00027355086,0.000022426131,0.0035876355],"genre_scores_gemma":[0.03139157,0.010188717,0.0006273705,0.81820846,0.13546853,0.0001549515,0.00010578369,0.00013300325,0.0037215394],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.92503595,0.037374567,0.008045424,0.010406256,0.01729026,0.0018476542],"domain_scores_gemma":[0.22446577,0.68890536,0.009864753,0.0086863125,0.06520854,0.002869129],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09705065,0.0010921448,0.002616765,0.0047011087,0.0054499856,0.006945854,0.008748523,0.03064492,0.008832511],"category_scores_gemma":[0.49631166,0.0009866495,0.0022545767,0.004428338,0.014329148,0.0062100966,0.0033769975,0.027475506,0.0042257085],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054236734,0.000036630052,0.0012211053,0.0023596901,0.00041177834,0.0005093194,0.0028102382,0.00008627594,0.00017830137,0.01451914,0.9543696,0.022955602],"study_design_scores_gemma":[0.00089326414,0.00021210592,0.020258566,0.024350144,0.0016383533,0.00084283255,0.006520326,0.0010683828,0.0015324512,0.058757458,0.88345003,0.00047612595],"about_ca_topic_score_codex":0.04168672,"about_ca_topic_score_gemma":0.031730503,"teacher_disagreement_score":0.09705065,"about_ca_system_score_codex":0.0109433085,"about_ca_system_score_gemma":0.008761441,"threshold_uncertainty_score":0.51325905},"labels":[],"label_agreement":null},{"id":"W3163934965","doi":"10.18432/ari29549","title":"WRITING SOCIOLOGICAL CRIME FICTION","year":2021,"lang":"en","type":"article","venue":"Art/Research International A Transdisciplinary Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Economic and Social Research Council; Arts and Humanities Research Council","keywords":"Narrative; Sociology; Poetry; Sociological theory; Period (music); Literature; Criminology; Aesthetics; Media studies; Art; Social science","score_opus":0.23189266009476078,"score_gpt":0.5375479236377132,"score_spread":0.3056552635429524,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3163934965","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.41340506,0.005213559,0.07552676,0.06061996,0.0055648834,0.0015065597,0.0018122111,0.00077035755,0.43558058],"genre_scores_gemma":[0.9225792,0.0016279232,0.03335802,0.004107676,0.001136852,0.001073484,0.00088314345,0.0003822394,0.03485133],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.98938864,0.008273204,0.00023508923,0.0006388085,0.0012423643,0.00022195569],"domain_scores_gemma":[0.9301823,0.060376983,0.00152907,0.0051562823,0.0020315174,0.0007238116],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01059166,0.0006719301,0.00043218897,0.0017531075,0.007901952,0.0067482777,0.0018028574,0.0020914287,0.01892596],"category_scores_gemma":[0.04080745,0.00026853173,0.00032135873,0.0015474225,0.019567935,0.0042150253,0.004140471,0.0026860752,0.0023051207],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001385796,0.00035515171,0.0031611098,0.0011368849,0.00003822037,0.00095135166,0.3079659,0.0013142563,0.0022398338,0.4872208,0.08735777,0.10812018],"study_design_scores_gemma":[0.00005326784,0.00015530421,0.0022969828,0.0007880687,0.000013425362,0.000976025,0.08848134,0.001777788,0.00429696,0.081897944,0.8192111,0.00005175753],"about_ca_topic_score_codex":0.00094211276,"about_ca_topic_score_gemma":0.001935238,"teacher_disagreement_score":0.01892596,"about_ca_system_score_codex":0.003353039,"about_ca_system_score_gemma":0.0015890887,"threshold_uncertainty_score":0.06331366},"labels":[],"label_agreement":null},{"id":"W3164952737","doi":"10.21203/rs.3.rs-555402/v1","title":"Inferring global-scale temporal latent topics from news reports to predict public health interventions for COVID-19","year":2021,"lang":"en","type":"preprint","venue":"Research Square","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Scale (ratio); Psychological intervention; Public health interventions; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Public health; Data science; Computer science; Political science; Medicine; Virology; Geography; Nursing; Cartography; Infectious disease (medical specialty)","score_opus":0.4222150682479828,"score_gpt":0.5865042682387647,"score_spread":0.16428919999078184,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3164952737","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8628027,0.002586081,0.11420204,0.002364424,0.00034449162,0.0002898073,0.012448967,0.0018023193,0.0031591428],"genre_scores_gemma":[0.95656466,0.00052159897,0.030148564,0.00014816478,0.00029813423,0.00015539535,0.010879857,0.00006146208,0.001222299],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99911517,0.00033785668,0.00008302061,0.0002681574,0.00010475129,0.000091052905],"domain_scores_gemma":[0.9896825,0.0075706076,0.001172094,0.00046256022,0.0008581412,0.0002540337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034260317,0.00082799076,0.0006020462,0.0033410422,0.0003083172,0.0013675244,0.00077015447,0.001114027,0.001355962],"category_scores_gemma":[0.012266052,0.00036806116,0.00089082954,0.0018035518,0.00036535188,0.0014400101,0.0007989598,0.0014774849,0.0007938713],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013857889,0.0012071584,0.5154725,0.00084989704,0.00061063806,0.0007662573,0.001471487,0.18303081,0.008189039,0.0042572184,0.021421934,0.26133722],"study_design_scores_gemma":[0.000054917004,0.00014378727,0.061151642,0.00009042262,0.00016324014,0.00009317442,0.00043278304,0.9280738,0.002795958,0.0029716517,0.0039921184,0.000036495247],"about_ca_topic_score_codex":0.0070449878,"about_ca_topic_score_gemma":0.00842739,"teacher_disagreement_score":0.0070449878,"about_ca_system_score_codex":0.0006579066,"about_ca_system_score_gemma":0.0007429566,"threshold_uncertainty_score":0.018118799},"labels":[],"label_agreement":null},{"id":"W3165231223","doi":"10.1037/amp0000903","title":"Expert predictions of societal change: Insights from the world after COVID project.","year":2021,"lang":"en","type":"article","venue":"American Psychologist","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Ontario Ministry of Research and Innovation; Social Sciences and Humanities Research Council of Canada; Templeton World Charity Foundation","keywords":"PsycINFO; Pandemic; Coronavirus disease 2019 (COVID-19); Psychology; Value (mathematics); Politics; Scientific consensus; Set (abstract data type); Social psychology; Public relations; Sociology; Political science; MEDLINE; Law; Medicine; Computer science","score_opus":0.10726794596429037,"score_gpt":0.45931358079082374,"score_spread":0.3520456348265334,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3165231223","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.89546686,0.001625445,0.009955938,0.036780894,0.00017546403,0.00027298747,0.0016862726,0.000074274045,0.05396188],"genre_scores_gemma":[0.99050844,0.0007662077,0.0029823827,0.001903015,0.000044788394,0.00022064509,0.00076194643,0.00004699584,0.0027655943],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.98744893,0.010063432,0.00026935543,0.0006160952,0.0009088684,0.0006932697],"domain_scores_gemma":[0.91025007,0.081156716,0.0031878084,0.001214059,0.0026992469,0.0014921649],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019481845,0.00044378013,0.0002558964,0.001867999,0.006249996,0.0059863767,0.0019310004,0.002902316,0.0028858548],"category_scores_gemma":[0.05934578,0.00033271525,0.00026204588,0.0021327608,0.0049154083,0.007850576,0.005643624,0.0042006695,0.00047387576],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000055138924,0.00005578846,0.011667024,0.00014861154,0.0000131354445,0.0006681925,0.9505899,0.00043726747,0.00021067039,0.00647443,0.008753377,0.020926334],"study_design_scores_gemma":[0.0000057821826,0.00002644469,0.008994631,0.00026963578,0.0000054373777,0.000121482124,0.94738144,0.0015867125,0.00021635905,0.0068490044,0.034510527,0.000032625354],"about_ca_topic_score_codex":0.01985,"about_ca_topic_score_gemma":0.027814269,"teacher_disagreement_score":0.01985,"about_ca_system_score_codex":0.005111522,"about_ca_system_score_gemma":0.0034083414,"threshold_uncertainty_score":0.1030311},"labels":[],"label_agreement":null},{"id":"W3165669050","doi":"10.1007/s11135-021-01164-0","title":"Algorithmic thinking in the public interest: navigating technical, legal, and ethical hurdles to web scraping in the social sciences","year":2021,"lang":"en","type":"article","venue":"Quality & Quantity","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":60,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Winnipeg; Carleton University; University of Toronto","funders":"","keywords":"Context (archaeology); Openness to experience; The Internet; Data sharing; Social media; Computer science; Principle of legality; World Wide Web; Data science; Internet privacy; Knowledge management; Public relations; Engineering ethics; Political science; Engineering; Psychology; Law","score_opus":0.279075911413793,"score_gpt":0.5367740553267564,"score_spread":0.25769814391296336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3165669050","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07016579,0.0043133716,0.6990159,0.17471471,0.000794485,0.00030293476,0.00029564352,0.0009451141,0.04945202],"genre_scores_gemma":[0.65460414,0.0020259242,0.32646984,0.009824807,0.0010451912,0.00056094694,0.00025178058,0.0007873286,0.0044300687],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9285536,0.058300808,0.0018574168,0.0026530887,0.007790811,0.0008442312],"domain_scores_gemma":[0.5693239,0.38318017,0.010267374,0.021157483,0.013440809,0.0026302754],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08383428,0.0005973809,0.0012031386,0.0063214893,0.0059794006,0.019366844,0.0039527556,0.005327185,0.01046392],"category_scores_gemma":[0.2861557,0.0009097514,0.0013430313,0.0044995267,0.031086072,0.028113717,0.008633071,0.009017224,0.0014817049],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000083898005,0.00016121272,0.005458554,0.00042939122,0.0001015225,0.00012369193,0.010457888,0.004834611,0.00040782677,0.866368,0.009465519,0.102107815],"study_design_scores_gemma":[0.00001248843,0.000007948545,0.00040669506,0.00017870443,0.000011450107,0.000033172804,0.0015335423,0.0066642095,0.00022138783,0.9859553,0.004959841,0.000015245763],"about_ca_topic_score_codex":0.0039692502,"about_ca_topic_score_gemma":0.006248583,"teacher_disagreement_score":0.9161657,"about_ca_system_score_codex":0.0044818167,"about_ca_system_score_gemma":0.0110407155,"threshold_uncertainty_score":0.44336337},"labels":[],"label_agreement":null},{"id":"W3166167806","doi":"","title":"Promoting Novelty, Rigor, and Style in Energy Social Science: Towards Codes of Practice for Appropriate Methods and Research Design","year":2018,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Novelty; Management science; Computer science; Rigour; Construct (python library); Data science; Quality (philosophy); Engineering ethics; Creativity; Style (visual arts); Knowledge management; Psychology; Epistemology; Social psychology; Engineering","score_opus":0.08873610965152295,"score_gpt":0.5054808450688868,"score_spread":0.41674473541736384,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3166167806","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010307861,0.01026624,0.86174214,0.08746787,0.003854561,0.015455232,0.00025878838,0.00067752204,0.009969834],"genre_scores_gemma":[0.06927634,0.0028535617,0.89189804,0.0059228614,0.0005834568,0.028400054,0.00014269284,0.0002521888,0.00067078904],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.10897211,0.77676374,0.060895864,0.011160276,0.040043905,0.0021640856],"domain_scores_gemma":[0.06791059,0.70894545,0.039832413,0.100780725,0.07840669,0.0041240724],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7808137,0.0036329303,0.0069644554,0.024647048,0.011072964,0.040053878,0.010225981,0.012981899,0.0022354864],"category_scores_gemma":[0.8333338,0.004178395,0.0043567196,0.017137695,0.076250315,0.03121535,0.031301692,0.021504499,0.0019598363],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041679252,0.0003590166,0.005490866,0.024009919,0.00063078786,0.00041204185,0.17849281,0.002765755,0.0029648824,0.46134868,0.016532997,0.3065755],"study_design_scores_gemma":[0.00055980205,0.00038772362,0.00291259,0.040027525,0.00032949593,0.00044348525,0.03444658,0.0065759947,0.0029530895,0.81264406,0.098257296,0.00046234284],"about_ca_topic_score_codex":0.0035402318,"about_ca_topic_score_gemma":0.004383075,"teacher_disagreement_score":0.2191863,"about_ca_system_score_codex":0.023804726,"about_ca_system_score_gemma":0.079663485,"threshold_uncertainty_score":0.2702958},"labels":[],"label_agreement":null},{"id":"W3166272135","doi":"10.22148/001c.24722","title":"Modeling Conflict: Representations of Social Groups in Present-Day Dutch Literature","year":2021,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Narratology; Narrative; Representation (politics); Sociology; Epistemology; Psychology; Literature; Politics; Political science; Art; Philosophy; Law","score_opus":0.07713974378771252,"score_gpt":0.41915106394212137,"score_spread":0.3420113201544088,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3166272135","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7870645,0.0026057032,0.1632804,0.005361261,0.00008613204,0.00017217398,0.0020705003,0.00013218133,0.039227124],"genre_scores_gemma":[0.97718674,0.0004884393,0.019034082,0.00008183315,0.000021326086,0.00016640154,0.00079285307,0.00004022101,0.002188093],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99749017,0.0017720712,0.000106792184,0.0003026432,0.00022958935,0.00009867945],"domain_scores_gemma":[0.99189353,0.0065777586,0.00074853585,0.00042282636,0.00023939453,0.00011797124],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027438893,0.0003566033,0.00027331174,0.0018696854,0.0017262183,0.005586809,0.0013789284,0.0008706453,0.0027013165],"category_scores_gemma":[0.02006632,0.0003416883,0.0004030437,0.0031108519,0.0034232426,0.008796345,0.0026184716,0.0012303712,0.000307308],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022345713,0.00017057812,0.03962398,0.0005883893,0.00011476946,0.0012189088,0.3174036,0.024721768,0.0018724954,0.52462083,0.006840609,0.08260056],"study_design_scores_gemma":[0.000051565494,0.000058394424,0.022415934,0.0004115508,0.000055015495,0.00075608114,0.19806114,0.21448037,0.0024737103,0.44192332,0.119223095,0.00008986383],"about_ca_topic_score_codex":0.011544271,"about_ca_topic_score_gemma":0.010595644,"teacher_disagreement_score":0.011544271,"about_ca_system_score_codex":0.0031646278,"about_ca_system_score_gemma":0.00081296795,"threshold_uncertainty_score":0.02296114},"labels":[],"label_agreement":null},{"id":"W3168278108","doi":"10.1017/pan.2021.37","title":"Cross-Domain Topic Classification for Political Texts","year":2021,"lang":"en","type":"article","venue":"Political Analysis","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"H2020 European Research Council; University of Essex; Università Bocconi; Eidgenössische Technische Hochschule Zürich; Wissenschaftszentrum Berlin für Sozialforschung; York University; London School of Economics and Political Science","keywords":"Computer science; Classifier (UML); Domain (mathematical analysis); Artificial intelligence; Natural language processing; Labeled data; Machine learning; Mathematics","score_opus":0.08141688647427724,"score_gpt":0.46420526801067685,"score_spread":0.3827883815363996,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3168278108","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3617499,0.002473823,0.6189905,0.0007665396,0.0003785077,0.0006810228,0.0026359626,0.0034607335,0.008863056],"genre_scores_gemma":[0.8198316,0.00031054844,0.17019422,0.000113159935,0.00023699296,0.00043221263,0.0062342165,0.00024522585,0.0024018434],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9903688,0.0056528584,0.00056499935,0.0018368787,0.0011742477,0.00040218173],"domain_scores_gemma":[0.9542038,0.034412105,0.0022740709,0.0039718486,0.0043877466,0.0007503316],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016094046,0.0011365734,0.0011051217,0.008384028,0.0016346251,0.003365829,0.0012400723,0.0016868294,0.002248029],"category_scores_gemma":[0.03532381,0.00036388586,0.0012518055,0.004605992,0.0011231225,0.0030000785,0.002468018,0.002351138,0.0016114058],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018043197,0.001544241,0.08518912,0.0009282091,0.0008309933,0.00053307874,0.0032335203,0.14251564,0.01454544,0.015480453,0.016773254,0.7166218],"study_design_scores_gemma":[0.000051325234,0.00014124278,0.015383093,0.00006976205,0.00006134583,0.00020761561,0.00086624554,0.9575075,0.007924411,0.0116162645,0.0061190506,0.000052155967],"about_ca_topic_score_codex":0.002408859,"about_ca_topic_score_gemma":0.0024083434,"teacher_disagreement_score":0.016094046,"about_ca_system_score_codex":0.0014657484,"about_ca_system_score_gemma":0.00095501775,"threshold_uncertainty_score":0.08511448},"labels":[],"label_agreement":null},{"id":"W3170686427","doi":"10.3389/frai.2021.664737","title":"Gender Bias in the News: A Scalable Topic Modelling and Visualization Framework","year":2021,"lang":"en","type":"article","venue":"Frontiers in Artificial Intelligence","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Simon Fraser University","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Simon Fraser University","keywords":"Latent Dirichlet allocation; Topic model; Mainstream; Representation (politics); Entertainment; Politics; Computer science; Data science; Psychology; Political science; Artificial intelligence","score_opus":0.1975284295315101,"score_gpt":0.4108134902179633,"score_spread":0.21328506068645323,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3170686427","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019665783,0.0009736079,0.9551451,0.0011001647,0.00017792288,0.00029408306,0.0057787127,0.014040465,0.0028240965],"genre_scores_gemma":[0.22030658,0.00068679696,0.76563954,0.00021441067,0.00035845704,0.000918571,0.0078092464,0.0012354642,0.0028309606],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99770504,0.000899907,0.00017615098,0.0005540252,0.0005173762,0.00014758669],"domain_scores_gemma":[0.9915964,0.0050489823,0.0007771961,0.00091030524,0.0013733924,0.00029382744],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005702454,0.0012014769,0.0009848775,0.0067375437,0.0009659137,0.003983969,0.0018172304,0.001373507,0.0040861038],"category_scores_gemma":[0.02157813,0.00068510923,0.0017460895,0.0048283446,0.0005811678,0.0033563774,0.0026458926,0.001748901,0.0019922338],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00093332375,0.00033072435,0.023626594,0.0008101967,0.0004129314,0.00054598873,0.007223209,0.0557167,0.016308421,0.030177396,0.05056689,0.8133477],"study_design_scores_gemma":[0.00011732544,0.00009749133,0.0064500025,0.00013041949,0.00011684397,0.0002389995,0.0011054055,0.87953544,0.006180704,0.06373552,0.042203583,0.000088142115],"about_ca_topic_score_codex":0.0078665,"about_ca_topic_score_gemma":0.0107980305,"teacher_disagreement_score":0.0078665,"about_ca_system_score_codex":0.0010699792,"about_ca_system_score_gemma":0.0015798594,"threshold_uncertainty_score":0.030157804},"labels":[],"label_agreement":null},{"id":"W3171347074","doi":"10.21105/joss.03272","title":"academictwitteR: an R package to access the Twitter Academic Research Product Track v2 API endpoint","year":2021,"lang":"en","type":"article","venue":"The Journal of Open Source Software","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":227,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Track (disk drive); Product (mathematics); World Wide Web; Computer science; Operating system; Mathematics","score_opus":0.282066190315972,"score_gpt":0.5272027382753877,"score_spread":0.24513654795941564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3171347074","genre_codex":"dataset","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002327363,0.0013222967,0.112185344,0.0016414453,0.0010808591,0.0006518287,0.5341508,0.33346412,0.013175985],"genre_scores_gemma":[0.025083536,0.00152413,0.1789288,0.0028223903,0.0005833006,0.006954219,0.38860837,0.36795884,0.02753647],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9965682,0.0012138588,0.00038833442,0.00072081794,0.00083862676,0.00027009143],"domain_scores_gemma":[0.9853284,0.0088342745,0.0012434998,0.0019009487,0.0020800082,0.0006128912],"candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.00628144,0.0032758445,0.002855995,0.0042906804,0.0012331929,0.0043508983,0.003684193,0.0016596083,0.18661022],"category_scores_gemma":[0.054280393,0.0022330766,0.0034160274,0.004617186,0.00087892846,0.0037407866,0.0051075225,0.0034833811,0.21209723],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035704902,0.000027839644,0.0028106105,0.0017924076,0.0005642961,0.00015193908,0.00021669494,0.0010491217,0.0010138882,0.0029230448,0.96268845,0.026404727],"study_design_scores_gemma":[0.00064763613,0.00013013554,0.0075732665,0.0007304232,0.00079556444,0.00039423732,0.00018910499,0.010512338,0.0041872794,0.039438747,0.93505996,0.00034135676],"about_ca_topic_score_codex":0.005821177,"about_ca_topic_score_gemma":0.0098870825,"teacher_disagreement_score":0.99631584,"about_ca_system_score_codex":0.00091053866,"about_ca_system_score_gemma":0.003636778,"threshold_uncertainty_score":0.6242734},"labels":[],"label_agreement":null},{"id":"W3171592703","doi":"","title":"Thierry Warin, PhD: [Video] Montreal's AI Ecosystem: Finding the Balance between Fundamental Research and Societal Impacts","year":2021,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Center for Interuniversity Research and Analysis on Organizations; HEC Montréal","funders":"","keywords":"Balance (ability); Ecosystem; Environmental resource management; Environmental ethics; Sociology; Ecology; Environmental science; Psychology; Philosophy; Biology","score_opus":0.17069275136620637,"score_gpt":0.46903155772359145,"score_spread":0.2983388063573851,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3171592703","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016215021,0.022543985,0.004321116,0.8072285,0.05701947,0.00017118255,0.0028323387,0.0011147716,0.10314712],"genre_scores_gemma":[0.031980507,0.043146506,0.009048377,0.25064743,0.050558854,0.00043080345,0.0015081959,0.0017876388,0.6108917],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99953234,0.00012698412,0.0000118819635,0.00007957399,0.00019064047,0.00005849924],"domain_scores_gemma":[0.9952336,0.001356011,0.00009014392,0.00007853387,0.0014152668,0.0018264574],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016016641,0.000645428,0.00040021582,0.0011084382,0.0019037584,0.0024647731,0.00089930464,0.0018712414,0.120579615],"category_scores_gemma":[0.011760716,0.00025399047,0.00028439294,0.00078177865,0.0008520351,0.0020050139,0.0010493576,0.0043239202,0.029859213],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000073022543,0.000005171687,0.00010736418,0.00001897541,0.0000013206839,0.000033893073,0.00006219341,0.000012333588,0.000039130176,0.00015890734,0.98599166,0.013561864],"study_design_scores_gemma":[0.000018574776,0.00001462566,0.001393776,0.00018179331,0.0000085662,0.0003179755,0.00087993254,0.00018888754,0.00014893494,0.001504973,0.9953164,0.00002563869],"about_ca_topic_score_codex":0.09879292,"about_ca_topic_score_gemma":0.32993618,"teacher_disagreement_score":0.120579615,"about_ca_system_score_codex":0.0023469087,"about_ca_system_score_gemma":0.0038003128,"threshold_uncertainty_score":0.40337902},"labels":[],"label_agreement":null},{"id":"W3172226794","doi":"10.1016/j.regsciurbeco.2021.103711","title":"Urban economics in a historical perspective: Recovering data with machine learning","year":2021,"lang":"en","type":"article","venue":"Regional Science and Urban Economics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Economic and Social Research Council; Social Sciences and Humanities Research Council of Canada; Agence Nationale de la Recherche; Centre for Economic Policy Research","keywords":"Exploit; Perspective (graphical); Data science; Flexibility (engineering); Computer science; Quality (philosophy); Artificial intelligence; Epistemology; Economics; Computer security","score_opus":0.06850432648639783,"score_gpt":0.32026485871243143,"score_spread":0.2517605322260336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3172226794","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13007523,0.02397766,0.70720667,0.051708363,0.0011563953,0.000087534965,0.0045260396,0.0005396117,0.08072254],"genre_scores_gemma":[0.85071856,0.016908832,0.11500547,0.0011973021,0.0021919475,0.00008758358,0.002017639,0.00028921568,0.011583476],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992762,0.00042539375,0.000029872486,0.00011724978,0.00011030744,0.000040996714],"domain_scores_gemma":[0.9955968,0.0026865117,0.0004316553,0.00058724685,0.0005491811,0.00014859409],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002188215,0.00041102973,0.000449747,0.0054012924,0.00095484813,0.0032056812,0.0011647419,0.0008608867,0.0053263134],"category_scores_gemma":[0.01178897,0.00026952822,0.00039206812,0.006844238,0.0032015883,0.0061454354,0.0013138928,0.0017911,0.00070272066],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000044568704,0.00009992199,0.022342296,0.00035282143,0.00011547571,0.00025681456,0.0013334441,0.036050342,0.00031049945,0.71351814,0.017773118,0.20780261],"study_design_scores_gemma":[0.000006798545,0.000019039191,0.012099058,0.00033322297,0.000043997326,0.0001461979,0.001833896,0.085903615,0.00090360764,0.7988495,0.09982257,0.0000385083],"about_ca_topic_score_codex":0.008454205,"about_ca_topic_score_gemma":0.015723946,"teacher_disagreement_score":0.008454205,"about_ca_system_score_codex":0.0020027137,"about_ca_system_score_gemma":0.0012225424,"threshold_uncertainty_score":0.017818272},"labels":[],"label_agreement":null},{"id":"W3173872709","doi":"10.48550/arxiv.2106.05240","title":"A Century of Economic Policy Uncertainty Through the French-Canadian Lens","year":2021,"lang":"en","type":"preprint","venue":"RePEc: Research Papers in Economics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nowcasting; Index (typography); Relevance (law); Construct (python library); Security token; Political science; Regional science; Economic history; Economics; Economy; Geography; Computer science; Meteorology","score_opus":0.06634323660780114,"score_gpt":0.40486146344958074,"score_spread":0.33851822684177957,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3173872709","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.37785628,0.032157134,0.10735398,0.10381195,0.0014895377,0.00012790697,0.01872823,0.0010051791,0.35746986],"genre_scores_gemma":[0.96491706,0.0047931606,0.012843657,0.0012813414,0.0002948495,0.000030331663,0.0015015628,0.00013044995,0.014207546],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9980299,0.0004331239,0.00005908874,0.00036313626,0.0008322639,0.00028252558],"domain_scores_gemma":[0.9957575,0.002031371,0.0003615201,0.00027637064,0.001358897,0.00021421706],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028257093,0.00046262937,0.00055550004,0.0044896267,0.0058029336,0.010752779,0.0008625248,0.0012383845,0.0065503456],"category_scores_gemma":[0.011936238,0.0002630208,0.0003801992,0.008127057,0.003998018,0.0045161247,0.0015620213,0.0018102791,0.0003929976],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041471608,0.000030243817,0.019730382,0.00029633712,0.00013616397,0.00073151384,0.010917403,0.016201343,0.0012462698,0.7552189,0.040692095,0.15438457],"study_design_scores_gemma":[0.00003600993,0.000043116906,0.06304585,0.0006641187,0.0002019349,0.00037443277,0.021828359,0.044449013,0.0026532519,0.28405482,0.5823141,0.00033491448],"about_ca_topic_score_codex":0.9400465,"about_ca_topic_score_gemma":0.94699687,"teacher_disagreement_score":0.05995351,"about_ca_system_score_codex":0.04308326,"about_ca_system_score_gemma":0.031288054,"threshold_uncertainty_score":0.31259245},"labels":[],"label_agreement":null},{"id":"W3177180982","doi":"10.3917/risa.872.0363","title":"La couverture médiatique des rapports du Protecteur du citoyen du Québec : une analyse de contenu automatisée","year":2021,"lang":"fr","type":"article","venue":"Revue Internationale des Sciences Administratives","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval; École Nationale d'Administration Publique; Université du Québec à Montréal","funders":"","keywords":"Political science; Humanities; Philosophy; Molecular biology; Biology","score_opus":0.06253231162826507,"score_gpt":0.3551437399362329,"score_spread":0.2926114283079678,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3177180982","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6610665,0.012768054,0.0042476184,0.014486181,0.0004106516,0.00029213703,0.0038658448,0.00012591651,0.30273703],"genre_scores_gemma":[0.8744827,0.0057432833,0.0017549247,0.0011809731,0.00007714441,0.0001694522,0.0011822172,0.00008478298,0.11532455],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9964347,0.00079055916,0.00012485233,0.000358294,0.001730979,0.0005607423],"domain_scores_gemma":[0.9840186,0.004308705,0.0014842805,0.00054083735,0.0090377955,0.00060976035],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003247502,0.00047719406,0.00046648266,0.005169271,0.008581452,0.0067494474,0.0011785832,0.0011977045,0.018129991],"category_scores_gemma":[0.01049728,0.00033469984,0.00039093988,0.009953034,0.0043386724,0.0023285423,0.0017329347,0.0012764472,0.0011868224],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028346476,0.00012216004,0.1579622,0.0028123213,0.00022847466,0.0015394429,0.47384962,0.0012369377,0.0036404384,0.09086403,0.042710535,0.2247504],"study_design_scores_gemma":[0.0000135895525,0.00006501273,0.2827754,0.0021309366,0.0001499073,0.00021255629,0.24621238,0.0010461459,0.0014562843,0.0020178976,0.4637973,0.0001226344],"about_ca_topic_score_codex":0.9557978,"about_ca_topic_score_gemma":0.9672976,"teacher_disagreement_score":0.050886095,"about_ca_system_score_codex":0.050886095,"about_ca_system_score_gemma":0.050664,"threshold_uncertainty_score":0.3692062},"labels":[],"label_agreement":null},{"id":"W3193311321","doi":"10.2196/25242","title":"The Role of the Canadian Media During the Initial Response to the COVID-19 Pandemic: A Topic Modelling Approach Using Canadian Broadcasting Corporation News Articles","year":2021,"lang":"en","type":"article","venue":"JMIR Infodemiology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"University of British Columbia Hospital; University of British Columbia; Toronto Metropolitan University; McMaster University","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Pandemic; Corporation; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Broadcasting (networking); 2019-20 coronavirus outbreak; Political science; Computer science; Virology; Medicine; Law; Computer security; Outbreak; Infectious disease (medical specialty)","score_opus":0.2183785661908496,"score_gpt":0.4099281561876529,"score_spread":0.19154958999680327,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3193311321","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8766485,0.006691468,0.037435073,0.005430064,0.00027299454,0.0013082218,0.0471027,0.00069244707,0.024418546],"genre_scores_gemma":[0.94561195,0.0025081919,0.030710187,0.00022635143,0.00021168208,0.0006306279,0.016048731,0.00011116726,0.003940977],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9981834,0.00056220224,0.0001339237,0.00035849895,0.00049704965,0.00026492658],"domain_scores_gemma":[0.9820431,0.013423876,0.0014805394,0.0003098532,0.0022668515,0.00047581177],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.00466414,0.00074913335,0.0005042143,0.014555482,0.0021979022,0.0055147423,0.0009844543,0.00091223815,0.0023372155],"category_scores_gemma":[0.01847859,0.00039254158,0.0013066423,0.017152922,0.0012774281,0.0016679841,0.0012781048,0.0012247645,0.00043909202],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010441327,0.000258396,0.67531335,0.004127119,0.0008690769,0.0024677173,0.05491252,0.029340439,0.0057828994,0.018740831,0.03476986,0.17237371],"study_design_scores_gemma":[0.00010283231,0.00012210043,0.59699994,0.0015161434,0.001133381,0.00065330364,0.034514323,0.2654204,0.002851115,0.0075082495,0.08886331,0.00031491753],"about_ca_topic_score_codex":0.7096695,"about_ca_topic_score_gemma":0.6731287,"teacher_disagreement_score":0.98544455,"about_ca_system_score_codex":0.0100446,"about_ca_system_score_gemma":0.010221006,"threshold_uncertainty_score":0.5840807},"labels":[],"label_agreement":null},{"id":"W3194665160","doi":"10.18637/jss.v099.i02","title":"The <i>R</i> Package <b>sentometrics</b> to Compute, Aggregate, and Predict with Textual Sentiment","year":2021,"lang":"en","type":"article","venue":"Journal of Statistical Software","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Institut de Valorisation des Données; Innoviris; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; National Science Foundation","keywords":"R package; Computer science; Aggregate (composite); Indexation; Sentiment analysis; Workflow; Index (typography); Volatility (finance); Series (stratigraphy); Information retrieval; Econometrics; Natural language processing; Mathematics; World Wide Web; Database; Programming language; Economics","score_opus":0.017611648276824543,"score_gpt":0.32921699603574767,"score_spread":0.3116053477589231,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3194665160","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033619462,0.0008165541,0.3883452,0.0010697793,0.000885379,0.0004533298,0.11498995,0.4799657,0.010112184],"genre_scores_gemma":[0.0347128,0.001234905,0.5230596,0.0019063848,0.0005725621,0.0043660435,0.10732455,0.30952352,0.017299643],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9967024,0.0010757579,0.0003167398,0.00068570965,0.0009864455,0.0002329718],"domain_scores_gemma":[0.9871176,0.0069939825,0.0012999745,0.0024512876,0.0017658203,0.00037138665],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056522302,0.003960526,0.0023499674,0.0045859185,0.0010789293,0.0045581535,0.0023038096,0.0010473436,0.116957754],"category_scores_gemma":[0.0400102,0.0022168695,0.0033132557,0.0036040174,0.001142177,0.0026734662,0.003600307,0.0035390614,0.13140017],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043054455,0.000093046096,0.007651246,0.0027253858,0.001238498,0.0004298061,0.0004682694,0.005777791,0.0076007303,0.018045897,0.83556634,0.11997246],"study_design_scores_gemma":[0.00043812318,0.00018910918,0.010476276,0.0006309347,0.00048170146,0.0008715601,0.00018718856,0.047505904,0.022734657,0.06493273,0.85108244,0.00046945614],"about_ca_topic_score_codex":0.003885551,"about_ca_topic_score_gemma":0.005639477,"teacher_disagreement_score":0.116957754,"about_ca_system_score_codex":0.0009809092,"about_ca_system_score_gemma":0.0032870362,"threshold_uncertainty_score":0.39126265},"labels":[],"label_agreement":null},{"id":"W3194827031","doi":"10.1177/14614448211038761","title":"Using social media images as data in social science research","year":2021,"lang":"en","type":"article","venue":"New Media & Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":102,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Social Sciences and Humanities Research Council of Canada; Nova Scotia Research Innovation Trust","keywords":"Social media; Data science; Thematic analysis; Computer science; Social research; Coding (social sciences); Narrative; Thematic map; Sociology; Social science; Qualitative research; World Wide Web","score_opus":0.46893585226548545,"score_gpt":0.5683473242748014,"score_spread":0.09941147200931594,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3194827031","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016731512,0.9131604,0.022329913,0.019924102,0.0028039934,0.0025823077,0.0050086416,0.00011399708,0.017345129],"genre_scores_gemma":[0.13977742,0.7802212,0.05518748,0.008024081,0.0016434663,0.009266194,0.003973629,0.00021053015,0.0016959953],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92629826,0.04419745,0.01351308,0.004261367,0.0108787995,0.0008510714],"domain_scores_gemma":[0.5046233,0.44214332,0.020261187,0.008754351,0.0230991,0.0011187406],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06858966,0.0011171603,0.0022989276,0.0455186,0.0019990497,0.009887229,0.0024341133,0.0032656793,0.004859949],"category_scores_gemma":[0.2692396,0.0012496725,0.0026968047,0.032664347,0.005502175,0.014546122,0.00577329,0.00294775,0.0010867438],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018396038,0.000102202306,0.0091813905,0.43822992,0.002012888,0.0004818099,0.018924229,0.00072123995,0.0011391562,0.04039413,0.015626656,0.47300237],"study_design_scores_gemma":[0.00005738994,0.00013390677,0.009343222,0.65193903,0.0029477885,0.0004621015,0.01927216,0.00068504474,0.0014994736,0.023677588,0.28984398,0.00013825009],"about_ca_topic_score_codex":0.0043655457,"about_ca_topic_score_gemma":0.009526673,"teacher_disagreement_score":0.9314103,"about_ca_system_score_codex":0.0041921395,"about_ca_system_score_gemma":0.013686279,"threshold_uncertainty_score":0.3627411},"labels":[],"label_agreement":null},{"id":"W3200612959","doi":"10.22148/001c.28215","title":"Celebrating 5 Years of Cultural Analytics","year":2021,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Analytics; Data science; Computer science","score_opus":0.06948626028111493,"score_gpt":0.39423671341715394,"score_spread":0.324750453136039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3200612959","genre_codex":"commentary","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060809944,0.039180227,0.021202901,0.70882547,0.17084661,0.000098434124,0.0027657219,0.0019170673,0.049082518],"genre_scores_gemma":[0.12796319,0.055887,0.06415594,0.29272446,0.19475536,0.00052540115,0.0109031,0.0052938075,0.24779172],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98601633,0.003460262,0.00048487264,0.0013936327,0.0066785337,0.0019663533],"domain_scores_gemma":[0.92388064,0.015608702,0.0023084988,0.0077736643,0.02127617,0.0291523],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02752611,0.0015416683,0.0012157827,0.004668015,0.0071666385,0.025815751,0.0027045761,0.006066264,0.028666036],"category_scores_gemma":[0.06584215,0.0005737618,0.0014510426,0.00432027,0.008248025,0.02597242,0.021988949,0.017067445,0.015097332],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008346708,0.00004787999,0.0009359408,0.00020044224,0.000035320387,0.000092357135,0.001682433,0.000100344354,0.0003651994,0.03859481,0.89631283,0.061548952],"study_design_scores_gemma":[0.0000066274824,0.000030467643,0.00092292076,0.0002935917,0.000011156527,0.00009129355,0.0017318056,0.00021790872,0.00024504436,0.023135003,0.97327584,0.000038373408],"about_ca_topic_score_codex":0.005028865,"about_ca_topic_score_gemma":0.013473175,"teacher_disagreement_score":0.028666036,"about_ca_system_score_codex":0.0033162944,"about_ca_system_score_gemma":0.007825942,"threshold_uncertainty_score":0.14557374},"labels":[],"label_agreement":null},{"id":"W3204952429","doi":"10.2196/31510","title":"Global Research on Coronaviruses: Metadata-Based Analysis for Public Health Policies","year":2021,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"HEC Montréal","funders":"","keywords":"Metadata; Public health; Data science; Context (archaeology); Public domain; Global health; Computer science; Open science; Social network analysis; Public relations; Political science; World Wide Web; Social media; Medicine; Geography","score_opus":0.38021336647013426,"score_gpt":0.5753729945252435,"score_spread":0.19515962805510922,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3204952429","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.052434307,0.01290336,0.67462444,0.12135574,0.0010294806,0.0016576932,0.050477978,0.0025714799,0.082945466],"genre_scores_gemma":[0.40088958,0.008117059,0.5628669,0.0023871656,0.0006754196,0.002130932,0.020216398,0.0004168626,0.0022996974],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9533182,0.03387205,0.0050349208,0.0025934663,0.0044796914,0.00070167443],"domain_scores_gemma":[0.73056555,0.20148633,0.023034798,0.024214644,0.018426633,0.0022720264],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.071221426,0.00068928074,0.0010043412,0.03256033,0.0023487457,0.012684969,0.0023274724,0.0017926523,0.009205272],"category_scores_gemma":[0.18096384,0.0005120121,0.0014948879,0.052078865,0.0046769655,0.018509647,0.006194813,0.002218258,0.001561741],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000106971274,0.0001020914,0.056916375,0.0029157712,0.00024296764,0.00015626011,0.0063797943,0.00827538,0.000725833,0.70988023,0.022904065,0.19139425],"study_design_scores_gemma":[0.000053900163,0.00007858373,0.021343635,0.005842737,0.00023875151,0.000159826,0.020704592,0.025426544,0.0021277906,0.7048604,0.21903405,0.00012925772],"about_ca_topic_score_codex":0.010743593,"about_ca_topic_score_gemma":0.009333686,"teacher_disagreement_score":0.96743965,"about_ca_system_score_codex":0.00890586,"about_ca_system_score_gemma":0.019949518,"threshold_uncertainty_score":0.3766594},"labels":[],"label_agreement":null},{"id":"W3206493376","doi":"10.1177/10323732211040272","title":"The centrality of ethical utterances within professional narratives","year":2021,"lang":"en","type":"article","venue":"Accounting History","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Calgary; York University","funders":"","keywords":"Centrality; Situational ethics; Variety (cybernetics); Professional ethics; Narrative; Ethical code; Sociology; Meta-ethics; Professional conduct; Engineering ethics; Public relations; Information ethics; Psychology; Political science; Social psychology; Linguistics; Law; Computer science","score_opus":0.042336033569657795,"score_gpt":0.3735205362418797,"score_spread":0.3311845026722219,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3206493376","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97578764,0.0015811044,0.0058437884,0.0019039466,0.00018296958,0.000042615302,0.00022744409,0.000050122522,0.014380408],"genre_scores_gemma":[0.9972772,0.00041393284,0.0011545679,0.000060678223,0.00010342297,0.000030010697,0.00008770055,0.000031765885,0.00084077194],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9855275,0.008547716,0.0008316847,0.0016448633,0.0026697237,0.0007785349],"domain_scores_gemma":[0.81324804,0.15134603,0.02043024,0.0031935598,0.008508525,0.0032735735],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011005025,0.00040133562,0.00035124552,0.013351732,0.004233396,0.008181786,0.0007555363,0.0011243867,0.0018770973],"category_scores_gemma":[0.09987489,0.0005004754,0.00022176479,0.0076550185,0.007623554,0.010316028,0.0051236222,0.0014283627,0.00029718253],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013271156,0.000020637039,0.04466058,0.00023563307,0.000028988597,0.0006202902,0.9147843,0.00023369858,0.003083498,0.011211425,0.00076010125,0.024228148],"study_design_scores_gemma":[0.000014895435,0.0000619353,0.13678417,0.00050764426,0.00006183768,0.0008319563,0.78254306,0.0027923298,0.0026898992,0.012326154,0.06125822,0.00012792028],"about_ca_topic_score_codex":0.01233768,"about_ca_topic_score_gemma":0.016006412,"teacher_disagreement_score":0.013351732,"about_ca_system_score_codex":0.0035636656,"about_ca_system_score_gemma":0.0028171167,"threshold_uncertainty_score":0.058200836},"labels":[],"label_agreement":null},{"id":"W3209334996","doi":"","title":"SOC*4030: Topics in Sociology: Youth Violence","year":2010,"lang":"en","type":"article","venue":"TRAILS: Teaching Resources and Innovations Library for Sociology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Criminology; Sociology; Public relations; Social science; Political science","score_opus":0.04229966695027895,"score_gpt":0.3468834834163594,"score_spread":0.30458381646608046,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3209334996","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014796822,0.00635724,0.009747755,0.017377002,0.010629933,0.00077828125,0.07537662,0.009024726,0.8559116],"genre_scores_gemma":[0.04390176,0.0076279873,0.009770768,0.0018974176,0.00786178,0.0009240949,0.055397745,0.0052517364,0.8673668],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99923325,0.00019294622,0.00005230354,0.00007195551,0.00029769322,0.00015185682],"domain_scores_gemma":[0.99255085,0.0020352846,0.00036565037,0.00035860884,0.0013225524,0.0033670275],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0019602205,0.00094222045,0.000835113,0.008307289,0.0023931637,0.004726572,0.0011462321,0.0009832316,0.38521937],"category_scores_gemma":[0.005370948,0.0003547203,0.0004471835,0.010210822,0.0007795231,0.002479881,0.0042872615,0.0012150573,0.10992943],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000060008286,0.00013268663,0.0009254318,0.00046424818,0.0000041458147,0.000053696516,0.0006890082,0.000068238725,0.0003330797,0.0034018008,0.8426761,0.15119162],"study_design_scores_gemma":[0.000021488748,0.000033118697,0.0037297271,0.00023629927,0.000006421044,0.00006509301,0.00071769475,0.00012541086,0.0003040208,0.0020614567,0.99269027,0.00000892081],"about_ca_topic_score_codex":0.0062041287,"about_ca_topic_score_gemma":0.028391413,"teacher_disagreement_score":0.61478066,"about_ca_system_score_codex":0.0020860368,"about_ca_system_score_gemma":0.009217788,"threshold_uncertainty_score":0.87691},"labels":[],"label_agreement":null},{"id":"W3215074405","doi":"10.1145/3492844","title":"The Computational Thematic Analysis Toolkit","year":2022,"lang":"en","type":"article","venue":"Proceedings of the ACM on Human-Computer Interaction","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; University of Waterloo","keywords":"Computer science; Transparency (behavior); Thematic analysis; Data science; Variety (cybernetics); Interface (matter); Coding (social sciences); Computational model; Thematic map; Modular design; Computational sociology; Process (computing); Human–computer interaction; World Wide Web; Qualitative research; Artificial intelligence; Sociology","score_opus":0.07997970442216792,"score_gpt":0.4028001203780254,"score_spread":0.3228204159558574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3215074405","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019486581,0.00053974055,0.89962095,0.0021424205,0.0004199116,0.002636444,0.04076053,0.039521117,0.012410144],"genre_scores_gemma":[0.007126748,0.00029014348,0.96083164,0.000265869,0.000045243938,0.008475827,0.0143328365,0.004830079,0.0038016213],"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9834222,0.009647717,0.002354379,0.0017187281,0.002440551,0.00041640035],"domain_scores_gemma":[0.94068104,0.042124633,0.0026130262,0.0071568005,0.006381379,0.0010430188],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028178938,0.0020998998,0.0016428675,0.0075639063,0.0034091591,0.008543228,0.0056185443,0.0017120318,0.048513275],"category_scores_gemma":[0.06758262,0.002322917,0.0059596677,0.007632795,0.0021850823,0.007162398,0.01187579,0.0055810576,0.016854402],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039508726,0.00019078479,0.0028534995,0.008688971,0.0007805998,0.0009770618,0.024235908,0.012098684,0.005660468,0.21417165,0.40269095,0.3272564],"study_design_scores_gemma":[0.00019704679,0.000035525372,0.0013118079,0.0013422476,0.00016687551,0.00039984845,0.0026492162,0.03663697,0.0023322122,0.2537362,0.7009918,0.00020020422],"about_ca_topic_score_codex":0.010156543,"about_ca_topic_score_gemma":0.021720529,"teacher_disagreement_score":0.048513275,"about_ca_system_score_codex":0.0030102734,"about_ca_system_score_gemma":0.011810082,"threshold_uncertainty_score":0.16229302},"labels":[],"label_agreement":null},{"id":"W3215263527","doi":"10.22158/sll.v5n4p140","title":"How the Titles of Popular Songs have Changed over the Last 60 Years","year":2021,"lang":"en","type":"article","venue":"Studies in Linguistics and Literature","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Laurentian University","funders":"","keywords":"Popularity; Word (group theory); History; Discriminant; Discriminant function analysis; Literature; Linguistics; Computer science; Mathematics; Statistics; Psychology; Art; Artificial intelligence; Social psychology; Philosophy","score_opus":0.05204797068108312,"score_gpt":0.37962365877103665,"score_spread":0.3275756880899535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3215263527","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9724841,0.008856948,0.000443185,0.00077664235,0.00021943747,0.000020490086,0.004230075,0.000047101697,0.012922086],"genre_scores_gemma":[0.9888707,0.0032465989,0.00045489406,0.00012698668,0.00025514237,0.000015959089,0.0024204594,0.00003644807,0.004572766],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99896455,0.00024779773,0.00016160049,0.00022005373,0.00027081167,0.00013517405],"domain_scores_gemma":[0.99043334,0.0029283348,0.0033506034,0.00033788508,0.0021992347,0.0007506091],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012250602,0.00013553152,0.00021440108,0.0042564883,0.00049490365,0.0021762487,0.0003406748,0.0003852632,0.0058043175],"category_scores_gemma":[0.0091254525,0.00014876328,0.00022823407,0.0059953462,0.00069818017,0.001665951,0.00061394303,0.00037142404,0.0019809946],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045478743,0.000064205175,0.854061,0.0009553609,0.0002222939,0.0004184962,0.00976148,0.00029862777,0.00502309,0.0016151301,0.0069798883,0.1201456],"study_design_scores_gemma":[0.0000035310486,0.000036717356,0.9881436,0.000053972773,0.000019439409,0.00017524677,0.0022397244,0.000108902255,0.00026099788,0.00008630411,0.0088620335,0.000009404463],"about_ca_topic_score_codex":0.0070498525,"about_ca_topic_score_gemma":0.016842995,"teacher_disagreement_score":0.0070498525,"about_ca_system_score_codex":0.00049680297,"about_ca_system_score_gemma":0.00028374238,"threshold_uncertainty_score":0.019417405},"labels":[],"label_agreement":null},{"id":"W3215541196","doi":"10.22148/001c.30009","title":"The Generative Dissensus of Reading the Feminist Novel, 1995-2020: A Computational Analysis of Interpretive Communities","year":2021,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Feminism; Ambivalence; Sociology; Reading (process); Publishing; Criticism; TRACE (psycholinguistics); Generative grammar; Literary criticism; Epistemology; Gender studies; Psychology; Literature; Political science; Linguistics; Art; Social psychology; Law; Philosophy","score_opus":0.0553978990341914,"score_gpt":0.3932323339961122,"score_spread":0.3378344349619208,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3215541196","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9175,0.0011846643,0.046019357,0.0077876416,0.00010502127,0.00016515721,0.0012049202,0.00020169842,0.025831506],"genre_scores_gemma":[0.98410577,0.00016890008,0.013538759,0.00018673476,0.00005078957,0.00010925099,0.0008604162,0.00007566368,0.00090362213],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99111533,0.0058498275,0.00027410648,0.0012615771,0.0011495398,0.00034967894],"domain_scores_gemma":[0.9198906,0.07037872,0.0033882954,0.0036255235,0.0018064128,0.0009105599],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014568538,0.00032410322,0.0005386791,0.006077845,0.0041732076,0.010529151,0.0019088583,0.0014484429,0.0028166536],"category_scores_gemma":[0.07146597,0.0004316634,0.0009478864,0.0058111018,0.009494293,0.01076073,0.005557077,0.002350492,0.00043917572],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054590445,0.00024914046,0.107453376,0.0004239833,0.00022244974,0.001130455,0.36120433,0.014496453,0.0015940373,0.38335627,0.008578672,0.12074491],"study_design_scores_gemma":[0.00008639234,0.00007099409,0.06391955,0.00033978897,0.00012273583,0.00059182796,0.20707196,0.15505478,0.0025105595,0.5111724,0.058934245,0.00012477415],"about_ca_topic_score_codex":0.009935771,"about_ca_topic_score_gemma":0.013825368,"teacher_disagreement_score":0.014568538,"about_ca_system_score_codex":0.0046476503,"about_ca_system_score_gemma":0.0022648457,"threshold_uncertainty_score":0.07704669},"labels":[],"label_agreement":null},{"id":"W3215780868","doi":"10.1002/asi.24606","title":"Domain‐topic models with chained dimensions: Charting an emergent domain of a major oncology conference","year":2021,"lang":"en","type":"article","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research; Agence Nationale de la Recherche","keywords":"Metadata; Computer science; Domain (mathematical analysis); Topic model; Data science; Cluster analysis; Representation (politics); Dimension (graph theory); Information retrieval; World Wide Web; Artificial intelligence; Mathematics","score_opus":0.036839457839953973,"score_gpt":0.3095043316059609,"score_spread":0.27266487376600695,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3215780868","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6414748,0.0025003955,0.24755861,0.012449338,0.00030529703,0.00088384905,0.015875725,0.0016711554,0.07728088],"genre_scores_gemma":[0.94621795,0.0002679063,0.046800323,0.00009582922,0.000037478876,0.00030359553,0.0038496268,0.00015512516,0.0022723645],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99715424,0.0014986745,0.00018666031,0.0005073983,0.00036787632,0.00028516175],"domain_scores_gemma":[0.9701052,0.023890201,0.0015319311,0.0012601718,0.0019246595,0.0012877734],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0045049144,0.00036834515,0.00034341688,0.004855274,0.0017652956,0.007244644,0.0012171598,0.0013929801,0.008082273],"category_scores_gemma":[0.027649183,0.0003844625,0.0009299757,0.006460398,0.0024104705,0.008296497,0.003048248,0.0019409298,0.0010647039],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009880913,0.0003037039,0.14335744,0.0012577617,0.00024986744,0.0010708038,0.07340687,0.11980169,0.002589167,0.5099151,0.029212277,0.11784724],"study_design_scores_gemma":[0.00009030579,0.000106017476,0.036684103,0.00044861992,0.00010694664,0.000274663,0.038719807,0.5191834,0.0013619633,0.34261447,0.06029122,0.00011848621],"about_ca_topic_score_codex":0.030218659,"about_ca_topic_score_gemma":0.032097086,"teacher_disagreement_score":0.9954951,"about_ca_system_score_codex":0.0044422047,"about_ca_system_score_gemma":0.003238802,"threshold_uncertainty_score":0.060085535},"labels":[],"label_agreement":null},{"id":"W4200191791","doi":"10.1017/9781316579817.015","title":"Alphabetical Concordance of All Films and Television Series Analyzed, with Performance Years and Cast Members Analyzed","year":2021,"lang":"en","type":"other","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Concordance; Series (stratigraphy); Television series; Mathematics; Statistics; Art; Geography; Media studies; Geology; Sociology; Biology; Paleontology; Bioinformatics","score_opus":0.02092619611229915,"score_gpt":0.32007632795346946,"score_spread":0.29915013184117034,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200191791","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.060275376,0.0014912899,0.0035765164,0.0009339328,0.0013460846,0.00029907987,0.7885055,0.0021673976,0.1414049],"genre_scores_gemma":[0.2147223,0.0031035626,0.012907814,0.00055597664,0.00063983427,0.0008871113,0.6329119,0.0032437209,0.13102771],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99651366,0.00066662417,0.00069329323,0.0006718763,0.0011397306,0.00031490962],"domain_scores_gemma":[0.97357506,0.008959311,0.0029071912,0.0031023985,0.01058751,0.0008685823],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025639615,0.0007994724,0.0007170034,0.012531011,0.0014851367,0.0025662002,0.00089376746,0.00043145954,0.11701823],"category_scores_gemma":[0.028624004,0.00035854088,0.0005540169,0.015621879,0.00049049885,0.001193928,0.0015431356,0.00092984905,0.04356381],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010542215,0.00017809478,0.12109505,0.0029566996,0.0002315486,0.00045354548,0.004148929,0.00052562036,0.0029692457,0.0073803207,0.7306418,0.12836508],"study_design_scores_gemma":[0.000045687255,0.00007886759,0.3876754,0.0011408072,0.00017373942,0.0005995849,0.0075201667,0.00066863204,0.0024865116,0.002768954,0.59677625,0.00006538546],"about_ca_topic_score_codex":0.015592141,"about_ca_topic_score_gemma":0.026438221,"teacher_disagreement_score":0.11701823,"about_ca_system_score_codex":0.00075691415,"about_ca_system_score_gemma":0.0020048793,"threshold_uncertainty_score":0.39146495},"labels":[],"label_agreement":null},{"id":"W4200371363","doi":"10.31235/osf.io/4nhd6","title":"Jumpstarting the Justice Disciplines: A Computational-Qualitative Approach to Collecting and Analyzing Text and Image Data in Criminology and Criminal Justice Studies","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Winnipeg; University of Toronto","funders":"","keywords":"Computer science; Data science; Big data; Criminal justice; Context (archaeology); Field (mathematics); Process (computing); Qualitative property; World Wide Web; Data mining; Psychology; Machine learning; Criminology","score_opus":0.41243292257408426,"score_gpt":0.5327767658549387,"score_spread":0.12034384328085446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200371363","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.049929447,0.0013271811,0.88304305,0.023373308,0.00034489934,0.0051840916,0.0014508049,0.00028828415,0.035058893],"genre_scores_gemma":[0.30111247,0.00089626986,0.6779058,0.0037958818,0.00011749777,0.010038499,0.0006582858,0.00026512542,0.0052101994],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93860596,0.05402821,0.0010270342,0.0023029314,0.003213263,0.0008225768],"domain_scores_gemma":[0.90141726,0.081192344,0.0037234167,0.0070932745,0.005364252,0.0012094448],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.048419707,0.0010229343,0.00094718934,0.0082262615,0.011512609,0.011725727,0.0045273635,0.0025269818,0.006629465],"category_scores_gemma":[0.06863604,0.0010864115,0.0012195929,0.007507415,0.034142338,0.011673134,0.011471802,0.004407135,0.0009754447],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010082107,0.0002813099,0.005746464,0.0015444363,0.0000604009,0.0005410144,0.35484013,0.002826784,0.0019218327,0.548829,0.0068757143,0.076432005],"study_design_scores_gemma":[0.00008938654,0.00013001138,0.0032589769,0.0017952534,0.00005044433,0.0003089577,0.25789773,0.01254138,0.0022628547,0.60692406,0.11462249,0.000118491014],"about_ca_topic_score_codex":0.016702369,"about_ca_topic_score_gemma":0.027621662,"teacher_disagreement_score":0.9515803,"about_ca_system_score_codex":0.010021061,"about_ca_system_score_gemma":0.016368818,"threshold_uncertainty_score":0.2560709},"labels":[],"label_agreement":null},{"id":"W4200559754","doi":"10.3389/fpsyg.2021.791605","title":"Editorial: Using Evidence Based Analytics to Create Narratives for Police Decision Making","year":2021,"lang":"en","type":"editorial","venue":"Frontiers in Psychology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Narrative; Psychology; Analytics; Forensic psychology; Applied psychology; Data science; Criminology; Computer science","score_opus":0.08588780325110712,"score_gpt":0.4978731829774318,"score_spread":0.4119853797263247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200559754","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000024927002,0.0017637013,0.00015562879,0.02693194,0.96941537,0.000030946572,0.0001439301,0.00008768449,0.0014458902],"genre_scores_gemma":[0.0003765833,0.0024633273,0.00015688232,0.013807508,0.9735131,0.00004495783,0.000085276326,0.00006468811,0.0094875395],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99503726,0.00090272626,0.000636783,0.000569018,0.002558615,0.00029570673],"domain_scores_gemma":[0.9639621,0.017545385,0.0020201087,0.00084156106,0.011927921,0.003703093],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007768946,0.004155731,0.00340668,0.0059316596,0.0038624771,0.009026624,0.0036966584,0.013963135,0.042995993],"category_scores_gemma":[0.042880088,0.0011982505,0.0025700673,0.002008275,0.002446648,0.0048839897,0.00207054,0.0138755385,0.024971873],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021128173,0.0000055113983,0.000012549813,0.00012815063,0.000009342573,0.00004995716,0.000007514762,0.000014409194,0.00002452349,0.00014595718,0.9967932,0.002787732],"study_design_scores_gemma":[0.00009282761,0.000028140297,0.00024585388,0.0008372903,0.000055946482,0.00024440498,0.000054715776,0.00022088028,0.00013556331,0.0017440912,0.9963122,0.000028040724],"about_ca_topic_score_codex":0.0018725235,"about_ca_topic_score_gemma":0.0049061296,"teacher_disagreement_score":0.042995993,"about_ca_system_score_codex":0.0025171032,"about_ca_system_score_gemma":0.0034127627,"threshold_uncertainty_score":0.1438359},"labels":[],"label_agreement":null},{"id":"W4205736040","doi":"10.2196/preprints.30290","title":"Analysis and Visualization Latent Topic on COVID-19 Vaccine Tweet use two-stage topic modeling (Preprint)","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Topic model; Latent Dirichlet allocation; Pandemic; Social media; Coronavirus disease 2019 (COVID-19); Latent class model; Relevance (law); Data science; Computer science; Political science; Medicine; Information retrieval; World Wide Web; Infectious disease (medical specialty)","score_opus":0.12510570523643247,"score_gpt":0.4423062688415736,"score_spread":0.31720056360514115,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205736040","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2285686,0.0021572923,0.7226146,0.0030335959,0.000991077,0.0007061474,0.021316675,0.012578133,0.00803389],"genre_scores_gemma":[0.689298,0.0013471551,0.2715587,0.00023918232,0.0005311889,0.0009181614,0.020936776,0.000671012,0.014499921],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99933237,0.0002443299,0.00004559169,0.00016978766,0.00014145843,0.00006640375],"domain_scores_gemma":[0.9981084,0.0013278027,0.0001271031,0.000110511275,0.0002650431,0.00006109173],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014956725,0.00074264867,0.00043926912,0.0025730846,0.00046338033,0.0014646985,0.0005477789,0.0007983331,0.007323624],"category_scores_gemma":[0.0041750907,0.00027880608,0.0016971875,0.0015207531,0.00022430513,0.0011241228,0.00075206533,0.00085477513,0.002610772],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014682304,0.0005543559,0.08738384,0.0018953313,0.00065848406,0.0015149945,0.006777746,0.1310133,0.038506597,0.025663659,0.107106686,0.5974568],"study_design_scores_gemma":[0.000043568423,0.00011105667,0.017746562,0.00008790041,0.00008390476,0.00019787159,0.0011955465,0.9426617,0.0076980884,0.0068607954,0.023242038,0.00007101265],"about_ca_topic_score_codex":0.0083838655,"about_ca_topic_score_gemma":0.007471806,"teacher_disagreement_score":0.0083838655,"about_ca_system_score_codex":0.00044963593,"about_ca_system_score_gemma":0.000604171,"threshold_uncertainty_score":0.024499953},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"design_other","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W4205760491","doi":"10.22148/001c.32036","title":"The Humanities in Public: A Computational Analysis of US National and Campus Newspapers","year":2022,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Digital humanities; Newspaper; Humanities; Sociology; Meaning (existential); Publics; Media studies; Political science; Epistemology; Politics; Art; Law; Philosophy","score_opus":0.076590508968831,"score_gpt":0.3698167006261597,"score_spread":0.29322619165732866,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205760491","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97421104,0.00063173973,0.0016721798,0.0036322973,0.00003336742,0.000078562814,0.009033953,0.00017300996,0.010533882],"genre_scores_gemma":[0.9722705,0.00049945817,0.006250084,0.0003658073,0.00009904098,0.00018300582,0.017701125,0.00008442479,0.0025463891],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99809855,0.0009789768,0.0000951486,0.0002643758,0.0003517737,0.00021108556],"domain_scores_gemma":[0.9718098,0.023843423,0.0017743175,0.0011221177,0.00095974834,0.0004906264],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0018836261,0.00028204967,0.00044645197,0.0070058187,0.002687971,0.004859467,0.0012410945,0.0011841248,0.0053377342],"category_scores_gemma":[0.01595564,0.0003498016,0.0007410535,0.0140429735,0.0015884837,0.0045035463,0.0022401072,0.0015084774,0.0009972625],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011346746,0.0038252932,0.5997795,0.0011012232,0.00064869894,0.0032243733,0.05783521,0.02792519,0.0020879079,0.08703367,0.09681794,0.11858642],"study_design_scores_gemma":[0.00023147458,0.00018606977,0.40466353,0.00028514795,0.00033909405,0.0012295276,0.1230087,0.30823433,0.0021968717,0.033325676,0.12611565,0.00018388478],"about_ca_topic_score_codex":0.06929873,"about_ca_topic_score_gemma":0.07814514,"teacher_disagreement_score":0.9929942,"about_ca_system_score_codex":0.003588989,"about_ca_system_score_gemma":0.0015094725,"threshold_uncertainty_score":0.13779074},"labels":[],"label_agreement":null},{"id":"W4206037607","doi":"10.18584/iipj.2021.12.4.11153","title":"Framing Land Governance Issues in Indigenous and Settler Media within Canada","year":2022,"lang":"en","type":"article","venue":"International Indigenous Policy Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"Simon Fraser University; University of the Fraser Valley","funders":"","keywords":"Indigenous; Framing (construction); Newspaper; Corporate governance; Political science; Colonialism; News media; Metis; Sociology; Media studies; Law; Geography; Ecology; Business","score_opus":0.01669117360017033,"score_gpt":0.34618714710301907,"score_spread":0.32949597350284876,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206037607","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9153486,0.0015367661,0.00087969744,0.0037600086,0.000083714636,0.00012653497,0.00055728725,0.00003389649,0.0776735],"genre_scores_gemma":[0.99033654,0.0011094393,0.000731846,0.00038382522,0.000029329,0.000055516182,0.00025109918,0.00002341744,0.0070790425],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.99697816,0.000991195,0.00010490023,0.00033301633,0.00089461094,0.0006981091],"domain_scores_gemma":[0.98666686,0.00817543,0.0010561062,0.00035758375,0.0030241723,0.0007199429],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043195845,0.0004042203,0.00035962655,0.006220921,0.014178424,0.010870257,0.00089114753,0.0010081307,0.0043630716],"category_scores_gemma":[0.016130753,0.00024845716,0.00018950245,0.0085270265,0.0078392895,0.003375387,0.0034154754,0.0014977811,0.00025974427],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000089229434,0.000057624264,0.025277294,0.00028056078,0.000017405113,0.00076509605,0.9350364,0.00016661607,0.0013314161,0.011393741,0.0025861969,0.022998491],"study_design_scores_gemma":[0.000008977603,0.00001934862,0.036353506,0.0003458169,0.000034557343,0.00007208141,0.89551723,0.000510997,0.00081051,0.0011603013,0.06512691,0.0000397223],"about_ca_topic_score_codex":0.950667,"about_ca_topic_score_gemma":0.973928,"teacher_disagreement_score":0.07099664,"about_ca_system_score_codex":0.07099664,"about_ca_system_score_gemma":0.05553967,"threshold_uncertainty_score":0.5151191},"labels":[],"label_agreement":null},{"id":"W4206655023","doi":"10.2196/preprints.23957","title":"Public Opinions and Concerns Regarding the Canadian Prime Minister’s Daily COVID-19 Briefing: Longitudinal Study of YouTube Comments Using Machine Learning Techniques (Preprint)","year":2020,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Government (linguistics); Prime minister; Political science; Coronavirus disease 2019 (COVID-19); Prime time; Public relations; Law; Politics; Medicine","score_opus":0.40083041661141994,"score_gpt":0.46018961126761626,"score_spread":0.059359194656196324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206655023","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9880802,0.00020465333,0.00021378625,0.00088231673,0.00004308208,0.00013029255,0.007810782,0.000021889415,0.0026130415],"genre_scores_gemma":[0.9862919,0.00039834605,0.0006897654,0.00034219958,0.000056700006,0.0004441357,0.008332225,0.00002970045,0.0034150176],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99835086,0.00036159815,0.000105397085,0.00020988956,0.00065526995,0.0003169437],"domain_scores_gemma":[0.97789985,0.0069261584,0.004508571,0.00058251305,0.008649306,0.0014336936],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002427064,0.00028481704,0.00029084246,0.0029381043,0.0023032057,0.0021571254,0.000760659,0.0007846641,0.0030474365],"category_scores_gemma":[0.02411824,0.00024102106,0.00029625636,0.004810853,0.00086591707,0.0014505639,0.0010943756,0.0011074792,0.00083601545],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020824921,0.00018884827,0.88232964,0.00026896253,0.0000778734,0.00037332845,0.06996901,0.0002757297,0.00090103067,0.00040672728,0.018888535,0.02611205],"study_design_scores_gemma":[0.000005071369,0.00004047092,0.9432675,0.00010628607,0.00001634582,0.00004866553,0.047458965,0.0010050896,0.00023933481,0.000041190102,0.0077291653,0.000041887102],"about_ca_topic_score_codex":0.7624821,"about_ca_topic_score_gemma":0.83015496,"teacher_disagreement_score":0.2375179,"about_ca_system_score_codex":0.00733348,"about_ca_system_score_gemma":0.005832413,"threshold_uncertainty_score":0.47783333},"labels":[],"label_agreement":null},{"id":"W4213310220","doi":"10.1016/j.jbi.2022.104034","title":"Non-negative matrix factorization temporal topic models and clinical text data identify COVID-19 pandemic effects on primary healthcare and community health in Toronto, Canada","year":2022,"lang":"en","type":"article","venue":"Journal of Biomedical Informatics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":25,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"North York General Hospital; Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Pandemic; Health care; Computer science; Medicine; Artificial intelligence; Psychology; Coronavirus disease 2019 (COVID-19); Disease; Infectious disease (medical specialty); Pathology","score_opus":0.14565938081560043,"score_gpt":0.4946154215590821,"score_spread":0.3489560407434817,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4213310220","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.94077116,0.0023268966,0.0039371504,0.008020263,0.0001656748,0.00013027027,0.042424493,0.00012237047,0.0021016728],"genre_scores_gemma":[0.981106,0.00073535787,0.0016129495,0.00021142105,0.00007086399,0.000054516324,0.01352017,0.000027234037,0.002661466],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989863,0.00029331134,0.000082489685,0.00020536801,0.00014471702,0.00028780664],"domain_scores_gemma":[0.99298966,0.0031401005,0.00067766354,0.0002518886,0.0021738447,0.0007668616],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022539578,0.00045887922,0.00049637153,0.002049413,0.001491893,0.0016630754,0.001175751,0.0008050067,0.002468402],"category_scores_gemma":[0.011125758,0.00033907447,0.0007038919,0.003480069,0.0005754854,0.0007063507,0.0010066613,0.0013194192,0.00039154966],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006361657,0.00020390247,0.8970774,0.00034255136,0.00044580887,0.0007242951,0.003953154,0.017367972,0.000688289,0.0027139343,0.043128435,0.03271809],"study_design_scores_gemma":[0.000058797523,0.00005402185,0.8795549,0.00018379389,0.00023412934,0.00014436085,0.008456063,0.100382715,0.00033030062,0.0016449532,0.008882714,0.00007327987],"about_ca_topic_score_codex":0.98636407,"about_ca_topic_score_gemma":0.9885566,"teacher_disagreement_score":0.015689151,"about_ca_system_score_codex":0.015689151,"about_ca_system_score_gemma":0.025842523,"threshold_uncertainty_score":0.11383331},"labels":[],"label_agreement":null},{"id":"W4213451309","doi":"10.1177/01655515221074323","title":"Collaboration of issuing agencies and topic evolution of health informatisation policies in China","year":2022,"lang":"en","type":"article","venue":"Journal of Information Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Fundamental Research Funds for the Central Universities","keywords":"Government (linguistics); China; Health policy; The Internet; Latent Dirichlet allocation; Digital transformation; Political science; Public administration; Public relations; Business; Health care; Topic model; Computer science; World Wide Web; Law","score_opus":0.021005815361930774,"score_gpt":0.3741806686805789,"score_spread":0.3531748533186482,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4213451309","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9866356,0.0015628701,0.0019572866,0.0020933466,0.000053517146,0.000093499664,0.00063281786,0.000055667868,0.006915338],"genre_scores_gemma":[0.9945169,0.0007951063,0.0015641999,0.000108185865,0.000036313282,0.00007570099,0.00056850567,0.000015732734,0.0023194489],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9921366,0.0025711749,0.0010912418,0.0012097138,0.0018910298,0.0011002134],"domain_scores_gemma":[0.9806871,0.009823695,0.0040486744,0.00089259224,0.0030560603,0.0014917965],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.009677466,0.00026251475,0.00048183382,0.007168437,0.002570478,0.0036766236,0.00074524805,0.00091115624,0.0019910708],"category_scores_gemma":[0.023572214,0.0003318476,0.0005084278,0.01036777,0.0012561975,0.0037230419,0.0024130004,0.0006502393,0.0002862342],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029707325,0.00019409785,0.69632965,0.0009879444,0.00010714226,0.0016190755,0.099208735,0.003149444,0.002622466,0.01643114,0.0077484287,0.17130482],"study_design_scores_gemma":[0.000047882942,0.00012300588,0.8166858,0.00042282732,0.00021480469,0.0005186429,0.07807485,0.023005633,0.0032349299,0.0074021374,0.07011999,0.00014946755],"about_ca_topic_score_codex":0.05039813,"about_ca_topic_score_gemma":0.036599852,"teacher_disagreement_score":0.9928316,"about_ca_system_score_codex":0.006990374,"about_ca_system_score_gemma":0.013991465,"threshold_uncertainty_score":0.100209594},"labels":[],"label_agreement":null},{"id":"W4220984160","doi":"10.1016/j.patter.2022.100435","title":"Inferring global-scale temporal latent topics from news reports to predict public health interventions for COVID-19","year":2022,"lang":"en","type":"article","venue":"Patterns","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Pandemic; Coronavirus disease 2019 (COVID-19); Psychological intervention; Computer science; Public health; Topic model; Scale (ratio); Data science; Public health interventions; Transfer of learning; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Artificial intelligence; Machine learning; Medicine; Infectious disease (medical specialty); Geography","score_opus":0.20924455449136484,"score_gpt":0.4671266355461511,"score_spread":0.25788208105478627,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4220984160","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8979189,0.002351681,0.07119612,0.002379284,0.00019374432,0.00028545648,0.020079736,0.0011762107,0.004418931],"genre_scores_gemma":[0.95516187,0.00064883876,0.030767959,0.00009674278,0.00019471123,0.00012916511,0.012255493,0.000046654506,0.0006985317],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99921703,0.00032952416,0.00008235857,0.00020084923,0.00009215072,0.00007802062],"domain_scores_gemma":[0.98807436,0.008716491,0.0016415188,0.0003990243,0.0009367888,0.00023191494],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027843453,0.00066103943,0.00043480808,0.0052268133,0.00041001712,0.0016095487,0.00038886323,0.0006345925,0.0010617134],"category_scores_gemma":[0.011951425,0.0002551375,0.00078780187,0.0034802328,0.00032262807,0.0016101642,0.00066476053,0.0009023904,0.00048253572],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00095844385,0.0006051575,0.65288347,0.0009109376,0.0007310291,0.00089920894,0.0025440475,0.07544544,0.0076797395,0.0068006036,0.019738685,0.23080324],"study_design_scores_gemma":[0.00009233676,0.00021732762,0.24835308,0.00021243138,0.00037454066,0.00025059408,0.00252032,0.72260433,0.0035768568,0.011096417,0.010638347,0.0000634113],"about_ca_topic_score_codex":0.007822766,"about_ca_topic_score_gemma":0.010119511,"teacher_disagreement_score":0.007822766,"about_ca_system_score_codex":0.00075095275,"about_ca_system_score_gemma":0.0009827403,"threshold_uncertainty_score":0.015554428},"labels":[],"label_agreement":null},{"id":"W4224238637","doi":"10.2196/38587","title":"Author's Responses to Peer Reviews of “Toward Human Digital Twins for Cybersecurity Simulations on the Metaverse: Ontological and Network Science Approach”","year":2022,"lang":"en","type":"article","venue":"JMIRx Med","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Computer security; Metaverse; Data science; Human–computer interaction","score_opus":0.22326258963061982,"score_gpt":0.45913723968802367,"score_spread":0.23587465005740385,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4224238637","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008616365,0.0018059307,0.0013778704,0.6112244,0.37508923,0.00016694627,0.00085091416,0.0003393122,0.008283797],"genre_scores_gemma":[0.03073908,0.0074617015,0.006137422,0.5362189,0.26020452,0.0009887189,0.0019471846,0.0013743588,0.15492819],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.96618414,0.00659518,0.0035702642,0.002189268,0.019558819,0.0019022671],"domain_scores_gemma":[0.66224396,0.06590865,0.011331866,0.007531691,0.24558623,0.007397636],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.021165442,0.0011057762,0.0017436483,0.003675375,0.006473075,0.0077900807,0.002923526,0.014882666,0.03787198],"category_scores_gemma":[0.25836748,0.00075820746,0.0015720738,0.002668577,0.0023367372,0.0036787011,0.005233566,0.0101886345,0.024215573],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023101937,0.000007830254,0.00014041924,0.00014188138,0.00001000948,0.00007107366,0.00015973496,0.000032874737,0.00015818942,0.00040180061,0.99483335,0.0040197694],"study_design_scores_gemma":[0.000019461373,0.000018065344,0.0009752464,0.00034023248,0.00002053297,0.00011417431,0.00054420554,0.0003606406,0.00040703782,0.0006906134,0.9964676,0.00004226832],"about_ca_topic_score_codex":0.0071094125,"about_ca_topic_score_gemma":0.012463837,"teacher_disagreement_score":0.97883457,"about_ca_system_score_codex":0.00373659,"about_ca_system_score_gemma":0.0118397465,"threshold_uncertainty_score":0.12669444},"labels":[],"label_agreement":null},{"id":"W4224266765","doi":"10.3389/frai.2022.826207","title":"Computational Modeling of Stereotype Content in Text","year":2022,"lang":"en","type":"article","venue":"Frontiers in Artificial Intelligence","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"National Research Council Canada","funders":"National Research Council Canada","keywords":"Stereotype (UML); Psychology; Superordinate goals; Social psychology; Social media; Interpersonal communication; Interpretation (philosophy); Competence (human resources); Entertainment; Computer science; World Wide Web","score_opus":0.15849473212639442,"score_gpt":0.3718816369818105,"score_spread":0.21338690485541606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4224266765","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.39736107,0.0007267251,0.5863483,0.0035321836,0.00015158845,0.00030434184,0.004414598,0.001408428,0.00575279],"genre_scores_gemma":[0.8284101,0.00025339745,0.16301326,0.00031475825,0.00017737379,0.0006539418,0.004235012,0.00013998155,0.0028021834],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991781,0.00033849946,0.00005308608,0.00025371788,0.00011597765,0.00006047941],"domain_scores_gemma":[0.98591447,0.012451316,0.0007248188,0.0003781703,0.0003775584,0.00015373153],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021663269,0.00053459784,0.0006422128,0.0021906528,0.00071293436,0.0018638294,0.0018273619,0.0013650254,0.0022495706],"category_scores_gemma":[0.015747683,0.00054405065,0.0010798625,0.0016976164,0.0010778363,0.0028670987,0.0009649764,0.0012712514,0.00048595257],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032390072,0.00031617587,0.019111106,0.00033673568,0.00013249688,0.000537315,0.0016935937,0.86322445,0.0029659998,0.046882134,0.005582377,0.058893736],"study_design_scores_gemma":[0.0000046173323,0.000004314993,0.00051091233,0.0000043736663,0.0000033767305,0.00001107292,0.000040817726,0.990669,0.00010274619,0.008383805,0.00026235782,0.0000026359724],"about_ca_topic_score_codex":0.010476884,"about_ca_topic_score_gemma":0.016411366,"teacher_disagreement_score":0.010476884,"about_ca_system_score_codex":0.0017793424,"about_ca_system_score_gemma":0.0008946741,"threshold_uncertainty_score":0.020831823},"labels":[],"label_agreement":null},{"id":"W4224311899","doi":"10.1111/cars.12378","title":"A new method for computational cultural cartography: From neural word embeddings to transformers and Bayesian mixture models","year":2022,"lang":"en","type":"article","venue":"Canadian Review of Sociology/Revue canadienne de sociologie","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Artificial intelligence; Computer science; Latent semantic analysis; Word (group theory); Natural language processing; Linguistics","score_opus":0.05651616741544198,"score_gpt":0.36145419875380375,"score_spread":0.3049380313383618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4224311899","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014858479,0.000104753526,0.99729913,0.00022277878,0.000029945659,0.000022468637,0.000087459346,0.00019139712,0.00055618235],"genre_scores_gemma":[0.10283839,0.0005240971,0.89259595,0.00025568725,0.00014088163,0.00041463564,0.0005861632,0.0003326497,0.0023114868],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99715626,0.001739412,0.00015558262,0.00046593952,0.00039180965,0.00009095328],"domain_scores_gemma":[0.9920548,0.0057871006,0.0004374079,0.0009944165,0.000561115,0.0001651249],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004159798,0.0012318474,0.0009976198,0.003599072,0.00094759057,0.0034139017,0.0022488162,0.0012846562,0.0046021827],"category_scores_gemma":[0.026827957,0.00093049114,0.0021999413,0.0041990387,0.0031088102,0.008011456,0.004458851,0.0040962957,0.0013003424],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009896181,0.00006164212,0.00227772,0.00022529686,0.00019515927,0.000098053475,0.0013965738,0.08736521,0.0010166718,0.6462542,0.0046717487,0.25633878],"study_design_scores_gemma":[0.000017848202,0.000020014733,0.00028298434,0.000052088635,0.000029984702,0.00006498171,0.00014104469,0.40501523,0.0005543212,0.58751345,0.0062773484,0.000030670137],"about_ca_topic_score_codex":0.006425965,"about_ca_topic_score_gemma":0.006794915,"teacher_disagreement_score":0.006425965,"about_ca_system_score_codex":0.0015425883,"about_ca_system_score_gemma":0.0019076495,"threshold_uncertainty_score":0.02199936},"labels":[],"label_agreement":null},{"id":"W4225331947","doi":"10.16995/dscn.8076","title":"Mining Medical Journals: Religion and Ideology in Nineteenth-Century Medicine.","year":2022,"lang":"en","type":"article","venue":"Digital Studies / Le champ numérique","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Ideology; Humanities; Vocabulary; Library science; Sociology; Art; Political science; Linguistics; Philosophy; Computer science; Politics; Law","score_opus":0.05227453801467093,"score_gpt":0.38131625298654265,"score_spread":0.32904171497187173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4225331947","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77606213,0.08415223,0.030102666,0.025831867,0.0013080457,0.00069256313,0.019304322,0.00042823338,0.0621178],"genre_scores_gemma":[0.89978606,0.016547883,0.059755046,0.0010317464,0.0008065559,0.00040290604,0.008603948,0.00019551099,0.012870425],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99374926,0.0028181877,0.0006456192,0.00061362254,0.0019588377,0.00021448548],"domain_scores_gemma":[0.96541345,0.02112385,0.00673624,0.0013497969,0.004506219,0.0008704411],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.0106242895,0.0002282445,0.0003313721,0.029685136,0.001815077,0.004857789,0.0006788536,0.0005692963,0.0027589104],"category_scores_gemma":[0.028556459,0.00022111576,0.0002850531,0.028941043,0.002647583,0.0023466863,0.0018035311,0.0006157303,0.0004968956],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032680048,0.00009923867,0.15717058,0.005263113,0.00020884555,0.0011110766,0.12044612,0.0013801012,0.008213499,0.05945816,0.026387248,0.6199352],"study_design_scores_gemma":[0.000041120355,0.00008221369,0.37538236,0.0023229655,0.00009682919,0.0007793236,0.056443438,0.0021239235,0.0037985889,0.014213587,0.5446415,0.0000742081],"about_ca_topic_score_codex":0.021489574,"about_ca_topic_score_gemma":0.043626484,"teacher_disagreement_score":0.9981849,"about_ca_system_score_codex":0.0051580127,"about_ca_system_score_gemma":0.0068985606,"threshold_uncertainty_score":0.056187272},"labels":[],"label_agreement":null},{"id":"W4226360438","doi":"10.1142/9789811239014_0013","title":"Predicting US Elections with Social Media and Neural Networks","year":2021,"lang":"en","type":"book-chapter","venue":"Series on language processing, pattern recognition, and intelligent systems","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Social media; Computer science; Artificial neural network; Political science; Artificial intelligence; World Wide Web","score_opus":0.04137972767914375,"score_gpt":0.29116265423457327,"score_spread":0.24978292655542952,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226360438","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7090069,0.013174913,0.20111102,0.008451272,0.0014082665,0.0001435649,0.0077189608,0.0015459962,0.0574391],"genre_scores_gemma":[0.95655996,0.0016301047,0.026797146,0.00019928909,0.0009062324,0.00005543032,0.0020570592,0.00006877487,0.011726047],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9997844,0.00008309895,0.000012353312,0.00004463404,0.00004249747,0.00003286798],"domain_scores_gemma":[0.99859494,0.0011039521,0.000110845554,0.000055164994,0.00009677531,0.00003834104],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008147357,0.0006993368,0.0004689233,0.0015250883,0.00028617526,0.0012116861,0.00057510287,0.00060243416,0.004346602],"category_scores_gemma":[0.0041804593,0.00035890716,0.00055562373,0.0013646797,0.00027989643,0.0015690849,0.0004038633,0.0010996222,0.0012685057],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046476012,0.00042518467,0.09112109,0.00015607175,0.0005064142,0.00016934676,0.00009623402,0.3705174,0.00088328467,0.015453122,0.04441746,0.47578964],"study_design_scores_gemma":[0.000009078486,0.000021454569,0.008305508,0.000024253482,0.000026422385,0.000026263308,0.000035480414,0.974796,0.00037541174,0.014577299,0.0017933181,0.000009401051],"about_ca_topic_score_codex":0.009600199,"about_ca_topic_score_gemma":0.02762329,"teacher_disagreement_score":0.009600199,"about_ca_system_score_codex":0.00067139365,"about_ca_system_score_gemma":0.00028068852,"threshold_uncertainty_score":0.019088626},"labels":[],"label_agreement":null},{"id":"W4231125566","doi":"10.29173/css14","title":"Introduction to the Special Issue: Rethinking Social Studies in Post-truth Era","year":2018,"lang":"en","type":"article","venue":"Canadian Social Studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Social studies; Social science; Sociology; Post truth; Epistemology; Political science; Pedagogy; Law; Philosophy; Politics","score_opus":0.09703151915299447,"score_gpt":0.4181758764360086,"score_spread":0.32114435728301416,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4231125566","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00040714274,0.050176643,0.0015873769,0.31445554,0.6156204,0.000053490097,0.0006197467,0.0001631853,0.016916515],"genre_scores_gemma":[0.00447375,0.03050879,0.0014139068,0.097693875,0.83351773,0.00015584326,0.0005270018,0.00039810507,0.031310912],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99663275,0.0011218694,0.00028955753,0.0005778971,0.0011194466,0.0002585103],"domain_scores_gemma":[0.9564944,0.030525494,0.0011753356,0.002156226,0.0063229874,0.00332549],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.0063775,0.001526228,0.0016763797,0.0061175316,0.0061417087,0.012962947,0.002405091,0.008990746,0.032490145],"category_scores_gemma":[0.027524278,0.0005270547,0.0014541909,0.005157384,0.007027949,0.010733421,0.0059564225,0.016571615,0.013623404],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000007238713,0.000014477737,0.00014772052,0.00014597947,0.0000047690996,0.000027685093,0.00045149744,0.000020758702,0.000057668505,0.008778776,0.9796769,0.010666426],"study_design_scores_gemma":[0.000004107278,0.000013025868,0.0006357456,0.0006120513,0.0000060501784,0.00006573807,0.00049281,0.00006203187,0.00003244887,0.007421956,0.99064094,0.000013138579],"about_ca_topic_score_codex":0.0058843205,"about_ca_topic_score_gemma":0.012939978,"teacher_disagreement_score":0.99481976,"about_ca_system_score_codex":0.0051802434,"about_ca_system_score_gemma":0.0045268782,"threshold_uncertainty_score":0.10869032},"labels":[],"label_agreement":null},{"id":"W4231501839","doi":"10.1007/978-1-4939-7131-2_101363","title":"Topic Model","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science","score_opus":0.10811279883984619,"score_gpt":0.3918284556562835,"score_spread":0.2837156568164373,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4231501839","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002971197,0.0026554964,0.89535284,0.0032209605,0.00090514775,0.0002725885,0.0051114713,0.0035910485,0.08591927],"genre_scores_gemma":[0.20334877,0.008192558,0.4063576,0.002337591,0.002527283,0.0016976924,0.026938383,0.0035907468,0.34500936],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986291,0.00045967867,0.000066650406,0.00042336682,0.00031871634,0.00010252143],"domain_scores_gemma":[0.9981927,0.000899755,0.000056291214,0.00039318166,0.00036039884,0.00009765966],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019481139,0.0011829884,0.0011202956,0.0019409448,0.00090778363,0.003782885,0.001900779,0.0015171588,0.04354633],"category_scores_gemma":[0.008120007,0.00055618427,0.0017452918,0.0023274878,0.00063927734,0.0044471025,0.0018887322,0.0026779033,0.036059137],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000110166126,0.00011712818,0.0007535981,0.0004721339,0.0001369251,0.000097799595,0.00036782576,0.018600894,0.0022324158,0.42826617,0.19461115,0.35423374],"study_design_scores_gemma":[0.000040326064,0.00004265309,0.00064378453,0.00014021964,0.000112783375,0.0002874726,0.0001750305,0.20044793,0.002044075,0.4920277,0.3039828,0.00005525129],"about_ca_topic_score_codex":0.003373047,"about_ca_topic_score_gemma":0.0038056853,"teacher_disagreement_score":0.04354633,"about_ca_system_score_codex":0.0011554329,"about_ca_system_score_gemma":0.0015800514,"threshold_uncertainty_score":0.14567697},"labels":[],"label_agreement":null},{"id":"W4232002330","doi":"10.1101/2021.06.10.21257749","title":"Inferring global-scale temporal latent topics from news reports to predict public health interventions for COVID-19","year":2021,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Pandemic; Coronavirus disease 2019 (COVID-19); Psychological intervention; Scale (ratio); Computer science; Public health; Data science; Public health interventions; Transfer of learning; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Artificial intelligence; Machine learning; Medicine; Geography; Infectious disease (medical specialty); Pathology","score_opus":0.22292848791227726,"score_gpt":0.47184569742067606,"score_spread":0.2489172095083988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4232002330","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8854655,0.0032550865,0.07136691,0.0044843704,0.00026808036,0.00028763045,0.028392626,0.00158905,0.004890755],"genre_scores_gemma":[0.94938743,0.0007749527,0.031778786,0.00014969026,0.000319543,0.00012899716,0.01655441,0.000068247195,0.0008379304],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990074,0.00046213012,0.000083682826,0.00023833745,0.00012427178,0.000084133666],"domain_scores_gemma":[0.98588073,0.010560294,0.0017921426,0.00047384878,0.000985161,0.00030788925],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0039316276,0.0006641089,0.00047302034,0.0049691745,0.0003663174,0.0018676539,0.00044111226,0.0007223134,0.0012742716],"category_scores_gemma":[0.014030666,0.00026522804,0.00084303186,0.0030086178,0.00036343327,0.001194565,0.00075758743,0.001088291,0.00060470647],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013562904,0.0005252165,0.6251629,0.0012199271,0.00097314134,0.0008090975,0.0019903996,0.11897902,0.008520323,0.0071880044,0.030119,0.20315664],"study_design_scores_gemma":[0.00011221868,0.00019867584,0.21233596,0.00026257796,0.0003658731,0.0002102672,0.0018345229,0.75594634,0.0037648464,0.012643466,0.012255004,0.00007033504],"about_ca_topic_score_codex":0.0068298974,"about_ca_topic_score_gemma":0.0073157693,"teacher_disagreement_score":0.0068298974,"about_ca_system_score_codex":0.0008497414,"about_ca_system_score_gemma":0.0010419873,"threshold_uncertainty_score":0.020792663},"labels":[],"label_agreement":null},{"id":"W4232469640","doi":"10.31223/x5zs5x","title":"Hydrology Research Articles are Becoming More Topically Diverse","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Universidad de Cantabria; University of Arizona; Nuclear Safety and Security Commission; University of Washington; University of Alabama; National Aeronautics and Space Administration","keywords":"Popularity; Hydrology (agriculture); Diversity (politics); Water resources; Catchment hydrology; Multidisciplinary approach; Hydrological modelling; Environmental science; Computer science; Sociology; Ecology; Social science; Psychology; Engineering","score_opus":0.31727309569265116,"score_gpt":0.5167985818824574,"score_spread":0.19952548618980626,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4232469640","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96954465,0.013321515,0.0022488805,0.0018617082,0.00014435977,0.00010808595,0.006895594,0.00011928159,0.0057559013],"genre_scores_gemma":[0.9829245,0.0044530407,0.004046233,0.0003879804,0.000645316,0.00014308341,0.0063726217,0.0000611573,0.0009661045],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9885434,0.002736554,0.002270618,0.0022286123,0.0035920793,0.0006287738],"domain_scores_gemma":[0.8078291,0.11121222,0.058372293,0.0035754223,0.015102934,0.003907989],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.013583511,0.00039619597,0.0010611118,0.038927607,0.0012833055,0.006550023,0.00060447166,0.00084775116,0.0023199553],"category_scores_gemma":[0.061720558,0.00026790317,0.0010363295,0.03672354,0.0012686332,0.005754149,0.0030807208,0.00091117795,0.00057813694],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049181975,0.00012545631,0.8600314,0.004285629,0.0012001343,0.0010880771,0.013940062,0.0015143618,0.009617979,0.0030785908,0.006903,0.09772349],"study_design_scores_gemma":[0.00005965884,0.0001693515,0.95421714,0.0004400163,0.00055966765,0.0012372397,0.009855249,0.002430979,0.002334149,0.005040433,0.023583043,0.00007306976],"about_ca_topic_score_codex":0.0021631494,"about_ca_topic_score_gemma":0.0035367531,"teacher_disagreement_score":0.98641646,"about_ca_system_score_codex":0.00094028114,"about_ca_system_score_gemma":0.0011306286,"threshold_uncertainty_score":0.071837306},"labels":[],"label_agreement":null},{"id":"W4233829821","doi":"10.1007/978-1-4939-7131-2_100230","title":"Culture Analytics","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Analytics; Computer science; Data science","score_opus":0.0752359675552887,"score_gpt":0.38609880388625417,"score_spread":0.31086283633096545,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4233829821","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024455842,0.0032612905,0.07055173,0.0073213894,0.0013768375,0.0001571795,0.0027657605,0.002493902,0.90962636],"genre_scores_gemma":[0.055848274,0.006319383,0.056431323,0.0021698594,0.0009727315,0.00037418382,0.00781235,0.001625396,0.8684464],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99920005,0.00019806207,0.000033032986,0.00014894141,0.00034674065,0.00007327766],"domain_scores_gemma":[0.99898523,0.00031967307,0.000041298306,0.00024633066,0.0003138014,0.000093639625],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00092197326,0.0010610936,0.00043607428,0.0031570331,0.00159096,0.007577754,0.0013068919,0.00096215983,0.08674506],"category_scores_gemma":[0.003742493,0.00031905514,0.0005291576,0.0037839403,0.0011251025,0.0071324822,0.0029901124,0.0019137422,0.040430654],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014248354,0.00003968508,0.0005169278,0.00016182059,0.00001076222,0.000037373455,0.0010461252,0.0005450084,0.00042167935,0.32531717,0.3014009,0.37048826],"study_design_scores_gemma":[0.0000020696134,0.0000040236564,0.00049184385,0.00018713296,0.000005166763,0.00004979727,0.0010533896,0.0015176336,0.0007789325,0.16872457,0.8271744,0.000011048581],"about_ca_topic_score_codex":0.00548936,"about_ca_topic_score_gemma":0.0075886915,"teacher_disagreement_score":0.08674506,"about_ca_system_score_codex":0.0020430572,"about_ca_system_score_gemma":0.002334323,"threshold_uncertainty_score":0.2901911},"labels":[],"label_agreement":null},{"id":"W4236125069","doi":"10.1007/978-1-4939-7131-2_100187","title":"Computational Social Science","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Computer science","score_opus":0.06859521179936953,"score_gpt":0.40039862344495564,"score_spread":0.33180341164558613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4236125069","genre_codex":"other","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001269946,0.028917793,0.110466205,0.018032465,0.0048654666,0.00007877325,0.0012594108,0.0010701923,0.8340397],"genre_scores_gemma":[0.019257654,0.018490361,0.035757054,0.0022644599,0.0038197623,0.00018905164,0.0022033483,0.0010133638,0.91700494],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.999474,0.00015184836,0.000015896183,0.00009773513,0.00023573078,0.000024883188],"domain_scores_gemma":[0.9988722,0.00065789267,0.000026776348,0.00018103371,0.00019331071,0.0000687384],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00076879974,0.0010131978,0.00059572665,0.0019165988,0.0010000451,0.0035167548,0.0007799693,0.0010907245,0.07264123],"category_scores_gemma":[0.0031791318,0.00032972245,0.00042570435,0.0021728592,0.0015299371,0.00362671,0.0015060495,0.002270151,0.036143698],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000004970478,0.000020574533,0.00010044555,0.00018289904,0.000008639048,0.000016576212,0.00017886609,0.00060816866,0.00015601558,0.38459727,0.42697304,0.18715256],"study_design_scores_gemma":[0.0000014781058,0.000001975549,0.0001140831,0.000110641275,0.0000023885366,0.000033327793,0.000051674895,0.0010083178,0.00013596773,0.3392113,0.6593243,0.0000046535047],"about_ca_topic_score_codex":0.0015262892,"about_ca_topic_score_gemma":0.004094555,"teacher_disagreement_score":0.07264123,"about_ca_system_score_codex":0.001700886,"about_ca_system_score_gemma":0.0018778819,"threshold_uncertainty_score":0.24300909},"labels":[],"label_agreement":null},{"id":"W4236556258","doi":"10.3410/f.1163652.627062","title":"Faculty Opinions recommendation of An RNA-dependent RNA polymerase formed by TERT and the RMRP RNA.","year":2009,"lang":"en","type":"dataset","venue":"Faculty Opinions – Post-Publication Peer Review of the Biomedical Literature","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"RNA; RNA polymerase; RNA-dependent RNA polymerase; RNA polymerase I; RNA editing; Molecular biology; Chemistry; Biology; Biochemistry; Gene","score_opus":0.03158055197323654,"score_gpt":0.3980963441738686,"score_spread":0.366515792200632,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4236556258","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006676025,0.00006773976,0.0001787243,0.00015852421,0.00008737824,0.000031867596,0.9965634,0.0006322356,0.001612519],"genre_scores_gemma":[0.0008210292,0.000040610703,0.0005827307,0.000058745318,0.000011431661,0.000039604867,0.9969415,0.00004665303,0.0014576196],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99856,0.0001817175,0.00014792364,0.00045776166,0.00047297208,0.00017962014],"domain_scores_gemma":[0.9974158,0.0004961085,0.00027519025,0.0007620793,0.00070818944,0.00034265895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001343048,0.002343769,0.001603393,0.0024388582,0.001096423,0.0022090056,0.002976906,0.0025084754,0.04043646],"category_scores_gemma":[0.004975825,0.0006373488,0.0016897235,0.003506743,0.0003768126,0.0012109027,0.0012311067,0.0020690192,0.06761463],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019490917,0.00006360961,0.0015309133,0.0005187327,0.00003723701,0.000029516315,0.000014940648,0.0003052501,0.00053494034,0.00028627997,0.99274844,0.003735285],"study_design_scores_gemma":[0.00046255713,0.000068498826,0.010687647,0.00018241057,0.00009968754,0.000107804066,0.00008377961,0.0026923248,0.003300164,0.0012296268,0.9810368,0.000048735525],"about_ca_topic_score_codex":0.026518723,"about_ca_topic_score_gemma":0.07078453,"teacher_disagreement_score":0.04043646,"about_ca_system_score_codex":0.0015213737,"about_ca_system_score_gemma":0.0028915808,"threshold_uncertainty_score":0.13527352},"labels":[],"label_agreement":null},{"id":"W4238104757","doi":"10.2139/ssrn.3872941","title":"Inferring Global-Scale Temporal Latent Topics From News Reports to Predict Public Health Interventions for COVID-19","year":2021,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"The Quebec Population Health Research Network; McGill University Health Centre; McGill University","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Psychological intervention; Scale (ratio); Topic model; Public health; Data science; 2019-20 coronavirus outbreak; Public health interventions; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Computer science; Political science; Medicine; Virology; Geography; Information retrieval; Nursing; Infectious disease (medical specialty)","score_opus":0.09982013897362861,"score_gpt":0.43829361706358183,"score_spread":0.3384734780899532,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4238104757","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7841759,0.005375145,0.15645781,0.007532841,0.00080915116,0.0004444022,0.035459466,0.0013127357,0.008432534],"genre_scores_gemma":[0.9563182,0.0008945616,0.025724726,0.00019602188,0.00038328674,0.00023736233,0.014114499,0.000062959574,0.0020683603],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988594,0.00058465573,0.00008505762,0.00029193825,0.00008632774,0.00009266234],"domain_scores_gemma":[0.9797121,0.017749242,0.0011524368,0.00047608325,0.00056147727,0.00034846112],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004402131,0.0008751479,0.0007319835,0.0039856606,0.0003774216,0.0017774123,0.0005491614,0.0011264586,0.0046853344],"category_scores_gemma":[0.020243933,0.00039654077,0.0011600958,0.002675879,0.00031471418,0.0020093014,0.0008637617,0.0017598186,0.0012810054],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003307525,0.0023749021,0.49099338,0.0016704289,0.0022562183,0.0007991904,0.002596505,0.087755576,0.005142858,0.019930167,0.038736723,0.34443653],"study_design_scores_gemma":[0.00023497292,0.0005414873,0.13466422,0.00033545485,0.001147069,0.00016928437,0.0014085139,0.814328,0.0017333567,0.037377413,0.007972856,0.000087406625],"about_ca_topic_score_codex":0.0062172604,"about_ca_topic_score_gemma":0.010026303,"teacher_disagreement_score":0.0062172604,"about_ca_system_score_codex":0.0006709986,"about_ca_system_score_gemma":0.0011385932,"threshold_uncertainty_score":0.023280978},"labels":[],"label_agreement":null},{"id":"W4242882238","doi":"10.22148/16.014","title":"Topic Modeling, Epistemology, and the English and German Novel","year":2017,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Contextualization; German; Context (archaeology); Historicism; Meaning (existential); Epistemology; Space (punctuation); Linguistics; Sociology; Philosophy; History; Interpretation (philosophy); Archaeology","score_opus":0.07670709901819155,"score_gpt":0.4049405778109269,"score_spread":0.32823347879273534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4242882238","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2289388,0.046428178,0.23795234,0.1068935,0.001848075,0.00009055002,0.0011916807,0.000576172,0.37608066],"genre_scores_gemma":[0.9758194,0.0032598905,0.010057582,0.0009640074,0.0006236574,0.0000659782,0.00022783272,0.0001464621,0.008835305],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99607915,0.0028137313,0.00015938775,0.00044955665,0.00029518784,0.00020307803],"domain_scores_gemma":[0.99284184,0.005794122,0.00046634243,0.00045466635,0.0002578066,0.0001852341],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0065846387,0.00053581985,0.0005557696,0.0033739419,0.002986054,0.0091923345,0.00084906194,0.0013455048,0.002713371],"category_scores_gemma":[0.009498481,0.00036161227,0.0005623279,0.0030817473,0.013673251,0.009795095,0.0026919534,0.0020204873,0.00045259533],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021142603,0.000013016216,0.0006736104,0.00005447377,0.000014901095,0.0000881853,0.008371454,0.0005306892,0.000051442345,0.97872317,0.0036709255,0.007786988],"study_design_scores_gemma":[0.000018134344,0.000013534567,0.001438069,0.00019665965,0.000018349576,0.00026666324,0.009823291,0.0042698337,0.0002796041,0.90350634,0.08014103,0.000028392042],"about_ca_topic_score_codex":0.005559473,"about_ca_topic_score_gemma":0.005370311,"teacher_disagreement_score":0.0091923345,"about_ca_system_score_codex":0.0051247305,"about_ca_system_score_gemma":0.0011664112,"threshold_uncertainty_score":0.03718269},"labels":[],"label_agreement":null},{"id":"W4244066710","doi":"10.1007/978-1-4939-7131-2_100494","title":"Influence Maximization","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Maximization; Mathematics; Mathematical optimization","score_opus":0.04115719752304595,"score_gpt":0.35052614740325816,"score_spread":0.3093689498802122,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4244066710","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016957612,0.0019124083,0.8031648,0.0012151661,0.00039139666,0.00010337485,0.0005317144,0.0009643096,0.19002111],"genre_scores_gemma":[0.1717278,0.0062490455,0.45747283,0.0015619596,0.0017044849,0.00073472696,0.0026699295,0.0023787008,0.35550058],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9989084,0.00036329962,0.00003650317,0.00028673362,0.00032907733,0.000075826276],"domain_scores_gemma":[0.9983644,0.00094062136,0.000047738085,0.00031714456,0.00025061058,0.00007946546],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012118004,0.0014052618,0.0011577195,0.0012452287,0.0008044476,0.0022192863,0.0014152008,0.0011411036,0.03365025],"category_scores_gemma":[0.0058109863,0.0004768676,0.0009340459,0.0014037999,0.0011726749,0.0020154736,0.0017186701,0.0018517282,0.015365977],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000034256682,0.000057806472,0.00020293074,0.00029487204,0.00006578076,0.000050493323,0.000114403025,0.027081687,0.0016785112,0.5620693,0.08544601,0.32290384],"study_design_scores_gemma":[0.000016421442,0.000022523673,0.00024398135,0.00009632796,0.000036959274,0.00011532137,0.00003257479,0.15571515,0.0027908515,0.7102658,0.1306391,0.00002496555],"about_ca_topic_score_codex":0.0016470342,"about_ca_topic_score_gemma":0.002652873,"teacher_disagreement_score":0.03365025,"about_ca_system_score_codex":0.0010007237,"about_ca_system_score_gemma":0.0010704073,"threshold_uncertainty_score":0.1125713},"labels":[],"label_agreement":null},{"id":"W4248200985","doi":"10.32920/14647158.v1","title":"The Big Data Gap: Is There Congruence Between Data Skills Demanded By The Industry And Canadian Academic Preparation?","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Seekers; Structuring; Curriculum; Big data; Field (mathematics); Public relations; Analytics; Data science; Computer science; Psychology; Political science; Pedagogy","score_opus":0.19941254059189803,"score_gpt":0.447723799910667,"score_spread":0.248311259318769,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4248200985","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"incentives","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"incentives","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9134539,0.0017525754,0.0016394121,0.019285524,0.00018416723,0.00007494056,0.0012344935,0.000038657556,0.062336374],"genre_scores_gemma":[0.9947805,0.00076617906,0.0007636631,0.0007986278,0.00002076457,0.000029325498,0.00033090886,0.000023588611,0.0024864706],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9894617,0.0014124516,0.00036984164,0.00085111486,0.005166548,0.0027383189],"domain_scores_gemma":[0.9696651,0.009371983,0.002853998,0.0012810293,0.0088964915,0.007931386],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.009848647,0.0002874827,0.000520059,0.0042037386,0.0111017665,0.007704719,0.0016460482,0.00078831887,0.007079435],"category_scores_gemma":[0.039484907,0.00037266134,0.0003723103,0.010675445,0.0060510254,0.0030331726,0.0048701735,0.0014532628,0.00047937606],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034195566,0.00018236182,0.4958121,0.00082299276,0.0000680015,0.00059839577,0.31184304,0.000458286,0.0013364352,0.041325185,0.020257117,0.12695415],"study_design_scores_gemma":[0.000009933908,0.000047915146,0.6542165,0.00049469527,0.000018691597,0.000107221975,0.29986766,0.0006252339,0.00037526895,0.0037974792,0.040371623,0.00006774237],"about_ca_topic_score_codex":0.9454686,"about_ca_topic_score_gemma":0.9669347,"teacher_disagreement_score":0.99015135,"about_ca_system_score_codex":0.046634793,"about_ca_system_score_gemma":0.12609552,"threshold_uncertainty_score":0.33836067},"labels":[],"label_agreement":null},{"id":"W4249822953","doi":"10.31235/osf.io/a29h8","title":"cesR: An R package for the Canadian Election Study","year":2020,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"R package; Download; Computer science; Reproducibility; Data science; Computational science; World Wide Web; Statistics; Mathematics","score_opus":0.15757271367032186,"score_gpt":0.45500450767185313,"score_spread":0.2974317940015313,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4249822953","genre_codex":"dataset","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026172425,0.0017558028,0.20136899,0.0031532405,0.0010869969,0.000985782,0.7214345,0.047596145,0.02000129],"genre_scores_gemma":[0.045029476,0.0027988574,0.3752973,0.0035545425,0.0006170701,0.008665178,0.43511277,0.09062062,0.038304254],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.994038,0.0026684524,0.0004133861,0.00082044344,0.0016349262,0.00042471229],"domain_scores_gemma":[0.96978486,0.017665995,0.0015368664,0.0044651804,0.005767277,0.00077978586],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009396006,0.0024515209,0.0019943453,0.004410036,0.0014043514,0.0033680624,0.0033769815,0.0011120617,0.15138368],"category_scores_gemma":[0.09192258,0.0015538527,0.0031186917,0.006735333,0.0008978383,0.0015752404,0.0030274997,0.0029082347,0.0430783],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013147757,0.000013753388,0.0054331603,0.000974821,0.00077554764,0.000116144256,0.00016299775,0.004128703,0.00016655041,0.018754764,0.92991036,0.039431676],"study_design_scores_gemma":[0.00035350965,0.000031318756,0.011616583,0.000529803,0.00045932998,0.00020820087,0.0000883491,0.010174148,0.00045722298,0.031627048,0.9442947,0.00015971035],"about_ca_topic_score_codex":0.36829364,"about_ca_topic_score_gemma":0.43399853,"teacher_disagreement_score":0.63170636,"about_ca_system_score_codex":0.004344836,"about_ca_system_score_gemma":0.02337043,"threshold_uncertainty_score":0.73229986},"labels":[],"label_agreement":null},{"id":"W4249951295","doi":"10.1016/b978-0-12-849878-1.00019-3","title":"Evidence Types and Enhancement","year":2018,"lang":"en","type":"book-chapter","venue":"Elsevier eBooks","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Trois-Rivières","funders":"","keywords":"Business","score_opus":0.06868798398997182,"score_gpt":0.3568461593507879,"score_spread":0.28815817536081606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4249951295","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036833687,0.013439523,0.60433525,0.008235026,0.0028185523,0.0005590444,0.0024704502,0.002644774,0.36181396],"genre_scores_gemma":[0.07266784,0.016073195,0.6489621,0.00144472,0.0027279165,0.000713075,0.003527605,0.0021115318,0.2517721],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9948067,0.0016922948,0.00068922923,0.0008028482,0.0018407793,0.00016812074],"domain_scores_gemma":[0.9751755,0.016103912,0.0007878408,0.004071248,0.0033269066,0.0005345567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009338626,0.0013761674,0.0012212907,0.00679302,0.0013045432,0.008986839,0.0028744845,0.0020544718,0.10451634],"category_scores_gemma":[0.046411432,0.0016711385,0.0014441485,0.004243241,0.002909694,0.013203978,0.004419014,0.003353173,0.031195868],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000094404924,0.000039868024,0.00049617246,0.00083624286,0.000033057113,0.00014617412,0.0003007566,0.00081414817,0.00095305184,0.3969066,0.03508415,0.56429535],"study_design_scores_gemma":[0.000023109325,0.000034053162,0.0004915073,0.0012542248,0.00007400635,0.0007855354,0.0002539438,0.0050666854,0.0032382424,0.67678916,0.31195065,0.000038995782],"about_ca_topic_score_codex":0.0008374366,"about_ca_topic_score_gemma":0.00091833394,"teacher_disagreement_score":0.10451634,"about_ca_system_score_codex":0.0015922867,"about_ca_system_score_gemma":0.0024728524,"threshold_uncertainty_score":0.34964198},"labels":[],"label_agreement":null},{"id":"W4251222113","doi":"10.32920/14647158","title":"The Big Data Gap: Is There Congruence Between Data Skills Demanded By The Industry And Canadian Academic Preparation?","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Curriculum; Big data; Structuring; Seekers; Public relations; Analytics; Field (mathematics); Data science; Computer science; Medical education; Psychology; Political science; Pedagogy","score_opus":0.19941254059189803,"score_gpt":0.447723799910667,"score_spread":0.248311259318769,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4251222113","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"incentives","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"incentives","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9134539,0.0017525754,0.0016394121,0.019285524,0.00018416723,0.00007494056,0.0012344935,0.000038657556,0.062336374],"genre_scores_gemma":[0.9947805,0.00076617906,0.0007636631,0.0007986278,0.00002076457,0.000029325498,0.00033090886,0.000023588611,0.0024864706],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9894617,0.0014124516,0.00036984164,0.00085111486,0.005166548,0.0027383189],"domain_scores_gemma":[0.9696651,0.009371983,0.002853998,0.0012810293,0.0088964915,0.007931386],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.009848647,0.0002874827,0.000520059,0.0042037386,0.0111017665,0.007704719,0.0016460482,0.00078831887,0.007079435],"category_scores_gemma":[0.039484907,0.00037266134,0.0003723103,0.010675445,0.0060510254,0.0030331726,0.0048701735,0.0014532628,0.00047937606],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034195566,0.00018236182,0.4958121,0.00082299276,0.0000680015,0.00059839577,0.31184304,0.000458286,0.0013364352,0.041325185,0.020257117,0.12695415],"study_design_scores_gemma":[0.000009933908,0.000047915146,0.6542165,0.00049469527,0.000018691597,0.000107221975,0.29986766,0.0006252339,0.00037526895,0.0037974792,0.040371623,0.00006774237],"about_ca_topic_score_codex":0.9454686,"about_ca_topic_score_gemma":0.9669347,"teacher_disagreement_score":0.99015135,"about_ca_system_score_codex":0.046634793,"about_ca_system_score_gemma":0.12609552,"threshold_uncertainty_score":0.33836067},"labels":[],"label_agreement":null},{"id":"W4251909731","doi":"10.1142/p981","title":"Exploring Big Historical Data","year":2014,"lang":"en","type":"book","venue":"IMPERIAL COLLEGE PRESS eBooks","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":66,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; Carleton University","funders":"","keywords":"Big data; History; Computer science; Data mining","score_opus":0.485653745540465,"score_gpt":0.38247656858607676,"score_spread":0.10317717695438822,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4251909731","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0079412805,0.06002413,0.52294356,0.020531878,0.0026489445,0.00015055035,0.010865771,0.004832002,0.37006187],"genre_scores_gemma":[0.12658514,0.08430412,0.43830496,0.0035392744,0.0023411822,0.00042456915,0.026071725,0.0036308884,0.31479815],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996371,0.00010403208,0.000020708741,0.00006667495,0.0001549989,0.00001643968],"domain_scores_gemma":[0.9978598,0.0015811811,0.000052691128,0.00031046924,0.0001343866,0.00006146134],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010287816,0.00070809806,0.00047988468,0.0029685644,0.0007305664,0.003987535,0.000750683,0.00061985076,0.025821483],"category_scores_gemma":[0.005673574,0.0006900807,0.0006285438,0.00500387,0.001317612,0.0061584758,0.0023993282,0.0017876278,0.005772765],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025777304,0.000016672611,0.0011646188,0.0005500792,0.000082145416,0.00018379839,0.001445853,0.0040459833,0.00047112282,0.17191634,0.25408575,0.56601185],"study_design_scores_gemma":[0.000003120765,0.000006593083,0.0010222422,0.00041688947,0.000022245036,0.00018170585,0.00065630407,0.0051727924,0.0004129645,0.3657739,0.62631226,0.000018957944],"about_ca_topic_score_codex":0.003360219,"about_ca_topic_score_gemma":0.008417541,"teacher_disagreement_score":0.025821483,"about_ca_system_score_codex":0.0007712112,"about_ca_system_score_gemma":0.00094001234,"threshold_uncertainty_score":0.086381435},"labels":[],"label_agreement":null},{"id":"W4252989330","doi":"10.31235/osf.io/af9jq","title":"Covering the Campaign: Computational Tools for Measuring Differences in Candidate and Party News Coverage with Application to an Emerging Democracy","year":2018,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Political science; Democracy; Computer science; Scheme (mathematics); General election; Social media; Campaign finance; Encoder; Public relations; Machine learning; Data science; Artificial intelligence; World Wide Web; Politics; Mathematics; Law","score_opus":0.08185793282105921,"score_gpt":0.3689788430749107,"score_spread":0.28712091025385145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4252989330","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.59151334,0.0006394285,0.38532326,0.0019908997,0.00006088731,0.0003396423,0.0077869156,0.0026630168,0.009682622],"genre_scores_gemma":[0.82045126,0.00014569252,0.17347948,0.000079423,0.00008200021,0.0003992263,0.0043784883,0.00008645343,0.0008980339],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99810237,0.0010671205,0.00013751535,0.00036006098,0.0002460665,0.00008687944],"domain_scores_gemma":[0.95966506,0.03494877,0.002495336,0.0017643778,0.0007890567,0.00033740103],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004643245,0.00057480315,0.00046233996,0.009246859,0.0007676398,0.0023025374,0.0008056413,0.0007608515,0.0029081947],"category_scores_gemma":[0.032676592,0.00028422268,0.00066376093,0.007395173,0.0008174501,0.0023106874,0.0016437194,0.0013096181,0.00062784384],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005189277,0.0007326077,0.31151915,0.00047074666,0.0005510145,0.00020725708,0.0039103595,0.07036911,0.0036759535,0.03993785,0.009804744,0.55830234],"study_design_scores_gemma":[0.00003548097,0.00006748778,0.07468449,0.00006581827,0.00005679324,0.00011176872,0.0014436338,0.89277554,0.0017388945,0.025243068,0.0037315658,0.00004541657],"about_ca_topic_score_codex":0.0081161745,"about_ca_topic_score_gemma":0.012547118,"teacher_disagreement_score":0.009246859,"about_ca_system_score_codex":0.0011049638,"about_ca_system_score_gemma":0.0009786553,"threshold_uncertainty_score":0.0245561},"labels":[],"label_agreement":null},{"id":"W4254981381","doi":"10.1111/j.1556-3502.2012.53701_s.x","title":"Opinion, In Focus, Knowledge Exchange, and Section News published exclusively online","year":2012,"lang":"en","type":"article","venue":"Anthropology News","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Mythology; Ethnography; Linguistic anthropology; Sociology; Anthropology; Kinship; Narrative; Art history; History; Classics; Art; Literature","score_opus":0.06786839663509038,"score_gpt":0.4284313511825001,"score_spread":0.3605629545474097,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4254981381","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00068843877,0.0036225745,0.000743181,0.09959051,0.18253125,0.00039341618,0.0046123886,0.00056797336,0.70725024],"genre_scores_gemma":[0.0033993416,0.0023523076,0.00030361692,0.022665365,0.03431886,0.00035182768,0.0017944545,0.0004572088,0.93435705],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99560285,0.00068615586,0.00023885498,0.00043596132,0.002224444,0.00081169535],"domain_scores_gemma":[0.99023086,0.0024794918,0.00057194266,0.00079039636,0.004010008,0.0019173756],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.004168221,0.00115002,0.0013428126,0.0023781678,0.0038518654,0.015573118,0.0023168891,0.012537172,0.6376323],"category_scores_gemma":[0.021530276,0.0006666487,0.0011073896,0.0034446977,0.001481438,0.012704117,0.0071708127,0.0061200974,0.4769777],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014236771,0.000009734436,0.000014195487,0.00008634697,0.0000015161851,0.00002170782,0.00005787383,0.0000066889506,0.00010911054,0.0012454411,0.9882317,0.01020151],"study_design_scores_gemma":[0.000012363285,0.000011297229,0.00020179969,0.00014843761,0.0000026682562,0.0000104742885,0.00033180427,0.000025012447,0.00006315376,0.0012037199,0.99798226,0.0000070525484],"about_ca_topic_score_codex":0.0029415244,"about_ca_topic_score_gemma":0.003950659,"teacher_disagreement_score":0.6376323,"about_ca_system_score_codex":0.0027710828,"about_ca_system_score_gemma":0.0068956665,"threshold_uncertainty_score":0.5168735},"labels":[],"label_agreement":null},{"id":"W4255804907","doi":"10.1506/mhp9-523e-q25v-vjvx","title":"Did Houston Clients of Arthur Andersen Recognize Publicly Available Bad News in a Timely Fashion?","year":2005,"lang":"en","type":"article","venue":"Contemporary Accounting Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Advertising; Psychology; Business","score_opus":0.1688976076431088,"score_gpt":0.43117585234574335,"score_spread":0.26227824470263456,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4255804907","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98690796,0.00016024795,0.00016878986,0.008908468,0.00001988545,0.000015704725,0.000077831304,0.000011602112,0.003729559],"genre_scores_gemma":[0.9969309,0.00025167913,0.00017035162,0.0007350247,0.00003468403,0.000007937282,0.00002964799,0.0000030604742,0.0018367253],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9986084,0.0005013597,0.00007565978,0.000120632525,0.00036386447,0.00032997484],"domain_scores_gemma":[0.97855055,0.007057718,0.010702261,0.00069554016,0.0014599469,0.00153407],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022748704,0.00010495892,0.0002774505,0.0007399656,0.0013012977,0.0028228343,0.0004245257,0.00092109607,0.0044808355],"category_scores_gemma":[0.025196122,0.00022123595,0.000108334716,0.0010819115,0.00088281825,0.0020053887,0.0007527708,0.001124691,0.0009630541],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031848377,0.0002961947,0.86493695,0.00005560611,0.00003240397,0.0010937585,0.02755675,0.00030746445,0.0010420182,0.0036628637,0.011873894,0.08882365],"study_design_scores_gemma":[0.000047038306,0.00029777535,0.8152691,0.00013827543,0.00006831011,0.0019297204,0.14438939,0.0055177542,0.0024360649,0.005703405,0.02409498,0.00010830977],"about_ca_topic_score_codex":0.018721348,"about_ca_topic_score_gemma":0.027749576,"teacher_disagreement_score":0.018721348,"about_ca_system_score_codex":0.0014958725,"about_ca_system_score_gemma":0.0020747888,"threshold_uncertainty_score":0.03722477},"labels":[],"label_agreement":null},{"id":"W4280563382","doi":"10.1007/s13222-022-00414-1","title":"An Ever-Expanding Humanities Knowledge Graph: The Sphaera Corpus at the Intersection of Humanities, Data Management, and Machine Learning","year":2022,"lang":"en","type":"article","venue":"Datenbank-Spektrum","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Berlin Center for Machine Learning; Institute for Information and Communications Technology Promotion; Banting and Best Diabetes Centre, University of Toronto; Korea University","keywords":"Intersection (aeronautics); Digital humanities; Period (music); Humanities; Knowledge transfer; Graph; Computer science; Artificial intelligence; Data science; Geography; Art; Cartography; Knowledge management; Theoretical computer science","score_opus":0.13153598567086283,"score_gpt":0.3591665838394898,"score_spread":0.22763059816862696,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4280563382","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.54332244,0.031126587,0.05117567,0.041674424,0.0021505295,0.00043577727,0.24557182,0.001848399,0.082694285],"genre_scores_gemma":[0.67179507,0.011535075,0.0795093,0.001842824,0.0006533606,0.0005756937,0.22028464,0.0009618243,0.012842242],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9972236,0.001058967,0.00023844112,0.0005555275,0.0008200703,0.00010341958],"domain_scores_gemma":[0.98046976,0.015034935,0.00087914587,0.0014573532,0.0015657322,0.0005930368],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0037744846,0.0002605809,0.00038842793,0.011439313,0.0023004976,0.0036843996,0.0009589362,0.0010514746,0.0050822045],"category_scores_gemma":[0.012329195,0.0002628491,0.00026822978,0.018344758,0.0030073537,0.0035581836,0.0033125079,0.0015020517,0.0014204417],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033580512,0.00035761477,0.040849335,0.005655919,0.00026125734,0.0042915368,0.032989286,0.0077784806,0.008648466,0.16307029,0.33968,0.396082],"study_design_scores_gemma":[0.000033509114,0.000020481935,0.04431413,0.0015538867,0.000051128107,0.00073745305,0.013042063,0.0049032876,0.0031108158,0.025244504,0.90691555,0.0000731727],"about_ca_topic_score_codex":0.020526178,"about_ca_topic_score_gemma":0.04435825,"teacher_disagreement_score":0.9885607,"about_ca_system_score_codex":0.0029008633,"about_ca_system_score_gemma":0.003358827,"threshold_uncertainty_score":0.040813386},"labels":[],"label_agreement":null},{"id":"W4281658977","doi":"10.1136/bmjebm-2022-podabstracts.24","title":"71 ‘Game changers’ decoding media misrepresentation of medical evidence","year":2022,"lang":"en","type":"article","venue":"Abstracts","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"College of Family Physicians of Canada; University of Alberta","funders":"","keywords":"Misrepresentation; Presentation (obstetrics); Psychological intervention; Icon; Computer science; Medical information; Medical literature; Internet privacy; Psychology; Knowledge management; Medicine; Political science; Psychiatry","score_opus":0.19407714427521996,"score_gpt":0.4619048555125786,"score_spread":0.2678277112373586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4281658977","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.32840377,0.0023485855,0.19357114,0.105011344,0.004176659,0.0029937956,0.0023409368,0.0024269954,0.35872674],"genre_scores_gemma":[0.8762871,0.0009039157,0.08348836,0.009572832,0.0006293182,0.0018908953,0.00080422853,0.00060589745,0.025817607],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.9464857,0.046482682,0.001361699,0.0015358274,0.0032373322,0.00089675956],"domain_scores_gemma":[0.7711926,0.19790553,0.009025677,0.008636461,0.011299077,0.0019406857],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.033755623,0.0011354922,0.00055408315,0.003237317,0.0038800417,0.013811184,0.0015401394,0.0029466306,0.022391539],"category_scores_gemma":[0.22200792,0.0005574179,0.0007698481,0.0019226703,0.0074125263,0.011783893,0.006199552,0.0035259724,0.0037922359],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011766125,0.00029557882,0.018587863,0.0025817037,0.000207021,0.0010991233,0.39637128,0.0017365657,0.0061582015,0.20088838,0.08292205,0.28797564],"study_design_scores_gemma":[0.00032805296,0.000504607,0.010738971,0.0037027884,0.00027785628,0.00092900515,0.20413753,0.019462824,0.007042752,0.15525661,0.5972238,0.00039520164],"about_ca_topic_score_codex":0.00381486,"about_ca_topic_score_gemma":0.004856846,"teacher_disagreement_score":0.9662444,"about_ca_system_score_codex":0.004076554,"about_ca_system_score_gemma":0.0026617153,"threshold_uncertainty_score":0.17851889},"labels":[],"label_agreement":null},{"id":"W4281727997","doi":"10.1007/s11229-022-03722-x","title":"The early days of contemporary philosophy of science: novel insights from machine translation and topic-modeling of non-parallel multilingual corpora","year":2022,"lang":"en","type":"article","venue":"Synthese","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Fonds de Recherche du Québec-Société et Culture; Canada Research Chairs; Canada Foundation for Innovation","keywords":"Computer science; Natural language processing; Philosophy of language; Machine translation; Artificial intelligence; Philosophy of science; German; Imperfect; English language; Parallel corpora; Linguistics; Corpus linguistics; Translation (biology); Computational linguistics; Translation studies; Information retrieval; Metaphysics; Philosophy","score_opus":0.08195013355325718,"score_gpt":0.3425887611974652,"score_spread":0.260638627644208,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4281727997","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026103819,0.020395359,0.86856294,0.040514443,0.001235998,0.0000735279,0.00066052866,0.00069694966,0.04175642],"genre_scores_gemma":[0.6826968,0.01114341,0.28764316,0.0030131917,0.0039613135,0.0003641283,0.0008457296,0.0011663102,0.009165895],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9940752,0.0039837584,0.0002281599,0.0006972593,0.000900271,0.00011540745],"domain_scores_gemma":[0.9602866,0.035062514,0.0006978408,0.002551285,0.0011609615,0.00024067074],"candidate_categories":["metaresearch","bibliometrics","sts"],"consensus_categories":[],"category_scores_codex":[0.011324762,0.0007395874,0.0012302053,0.005012334,0.0019124463,0.007751747,0.0017115436,0.002174545,0.0042783995],"category_scores_gemma":[0.034480542,0.0007704173,0.0007880992,0.005313823,0.011709746,0.019221265,0.002311322,0.004792126,0.000900986],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000039161834,0.000018437695,0.00032629728,0.000301439,0.000039045597,0.000063352054,0.0049155094,0.0019414027,0.00034714743,0.95197093,0.003956733,0.03608063],"study_design_scores_gemma":[0.000007066153,0.000005717469,0.00029687223,0.00010138265,0.000008533199,0.000055426575,0.0005055945,0.011338888,0.00036349637,0.96764004,0.01966372,0.000013165732],"about_ca_topic_score_codex":0.0016455185,"about_ca_topic_score_gemma":0.0021122764,"teacher_disagreement_score":0.9980875,"about_ca_system_score_codex":0.002759711,"about_ca_system_score_gemma":0.0024700265,"threshold_uncertainty_score":0.05989176},"labels":[],"label_agreement":null},{"id":"W4283269488","doi":"10.1371/journal.pone.0269582","title":"Machine learning shows that the Covid-19 pandemic is impacting U.S. public companies unequally by changing risk structures","year":2022,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"University of Science and Technology Beijing","keywords":"Coronavirus disease 2019 (COVID-19); Pandemic; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Quarter (Canadian coin); Mainstream; Shock (circulatory); Business; Distribution (mathematics); Risk factor; Business risks; Economics; Risk analysis (engineering); Political science; Medicine; Mathematics; Virology; History","score_opus":0.19854446132254142,"score_gpt":0.35978474238584346,"score_spread":0.16124028106330204,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4283269488","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93890107,0.0026634329,0.026192928,0.013507002,0.00024619774,0.00007139587,0.0032955396,0.00019703353,0.014925287],"genre_scores_gemma":[0.99353796,0.00073416845,0.0025876232,0.00033308382,0.000149107,0.000020134381,0.0014792781,0.00002141218,0.0011371273],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9991148,0.00029715843,0.00005664784,0.0002021137,0.00019394829,0.00013531717],"domain_scores_gemma":[0.9881092,0.008016612,0.001926731,0.00062779075,0.00094622053,0.00037344635],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033982755,0.00038913803,0.00036910054,0.0017085595,0.0010241986,0.0023146449,0.00030543306,0.00068448274,0.0029696359],"category_scores_gemma":[0.012131194,0.00014405353,0.00058646145,0.0026111794,0.00081718294,0.0018774013,0.0011500464,0.0013289922,0.00088476774],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014376378,0.00017807599,0.79203796,0.00017963602,0.00020859318,0.0002069095,0.0017309326,0.025750492,0.0008293439,0.018923067,0.020839725,0.13897145],"study_design_scores_gemma":[0.000026860473,0.00025784172,0.65896696,0.000277778,0.00014854436,0.00032847535,0.0039218613,0.25903168,0.0021662728,0.045456618,0.029311279,0.00010581339],"about_ca_topic_score_codex":0.01662394,"about_ca_topic_score_gemma":0.021347335,"teacher_disagreement_score":0.01662394,"about_ca_system_score_codex":0.0013658114,"about_ca_system_score_gemma":0.0008442726,"threshold_uncertainty_score":0.03305435},"labels":[],"label_agreement":null},{"id":"W4284878824","doi":"10.2196/40365","title":"Correction:The Associations Between Racially/Ethnically Stratified COVID-19 Tweets and COVID-19 Cases and Deaths: Cross-sectional Study (Preprint)","year":2022,"lang":"en","type":"erratum","venue":"JMIR Formative Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Preprint; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Ethnically diverse; Cross-sectional study; Medicine; Virology; Computer science; World Wide Web; Environmental health; Disease; Pathology; Infectious disease (medical specialty); Population","score_opus":0.2480628449235206,"score_gpt":0.5622583244480178,"score_spread":0.3141954795244972,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4284878824","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00030185693,0.0005381192,0.0018405089,0.05373947,0.9213171,0.00006256216,0.017545082,0.0014105522,0.003244748],"genre_scores_gemma":[0.050241843,0.008188815,0.025542023,0.12616593,0.3325681,0.0014096776,0.046402805,0.014746665,0.39473414],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9860036,0.0030294457,0.0030474197,0.0015949646,0.0055267494,0.00079786155],"domain_scores_gemma":[0.8717241,0.043763082,0.0055534523,0.010657591,0.065163895,0.0031378383],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014280397,0.0032560518,0.0023241497,0.0062681767,0.0043446855,0.0049690893,0.005229782,0.005448768,0.18137391],"category_scores_gemma":[0.26141658,0.0018135391,0.0024688684,0.0061285524,0.0026758448,0.0034936687,0.003645902,0.0096821375,0.067008734],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000032864646,0.0000031757093,0.000106388165,0.00016441819,0.000018084802,0.00010377294,0.000054458375,0.000028392436,0.000020818063,0.0004911416,0.9965245,0.0024520073],"study_design_scores_gemma":[0.00015453529,0.000031033855,0.0019805168,0.0017085436,0.0001412843,0.00069544296,0.0003414287,0.00063944364,0.0004539122,0.004192732,0.9895364,0.00012480872],"about_ca_topic_score_codex":0.039459374,"about_ca_topic_score_gemma":0.037004597,"teacher_disagreement_score":0.18137391,"about_ca_system_score_codex":0.0042548315,"about_ca_system_score_gemma":0.011838613,"threshold_uncertainty_score":0.6067562},"labels":[],"label_agreement":null},{"id":"W4285138469","doi":"10.1162/tacl_a_00487","title":"Heterogeneous Supervised Topic Models","year":2022,"lang":"en","type":"article","venue":"Transactions of the Association for Computational Linguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Mila - Quebec Artificial Intelligence Institute","funders":"Office of Naval Research; Simons Foundation; Alfred P. Sloan Foundation; National Science Foundation","keywords":"Computer science; Inference; Artificial intelligence; Outcome (game theory); Machine learning; Topic model; Bayes' theorem; Bayesian inference; Latent variable; Language model; Bayesian probability; Natural language processing; Probabilistic logic; Tone (literature); Linguistics","score_opus":0.043110221112365184,"score_gpt":0.32375089316931716,"score_spread":0.280640672056952,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285138469","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09319498,0.0011810911,0.8991059,0.0012079036,0.00015698982,0.00012844872,0.0013614288,0.0010433345,0.002619868],"genre_scores_gemma":[0.9010714,0.0005177825,0.08842243,0.00030644645,0.00053973764,0.00027815445,0.0030937055,0.00022591183,0.0055443607],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99719256,0.0015122871,0.00012574643,0.0007497307,0.00025806756,0.00016164247],"domain_scores_gemma":[0.9859291,0.011291061,0.0008556317,0.000882067,0.00085968577,0.00018249151],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055256085,0.001037423,0.0015834174,0.0018084612,0.00066263555,0.0017145844,0.0024817877,0.0018815026,0.003574236],"category_scores_gemma":[0.015116297,0.0006279444,0.001554629,0.0016057565,0.0012006727,0.0030596298,0.0012240584,0.0024888772,0.001135734],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044696275,0.00023764289,0.007444682,0.0003188367,0.0003539177,0.00022908338,0.00051292765,0.81522673,0.0017427471,0.054147914,0.008340361,0.11099816],"study_design_scores_gemma":[0.00001033277,0.000009427908,0.00026104215,0.000010410643,0.000010645904,0.000012608694,0.000010413394,0.9825963,0.00015222069,0.01663852,0.0002828065,0.000005456902],"about_ca_topic_score_codex":0.004565104,"about_ca_topic_score_gemma":0.0063799573,"teacher_disagreement_score":0.0055256085,"about_ca_system_score_codex":0.0012327665,"about_ca_system_score_gemma":0.000775667,"threshold_uncertainty_score":0.029222548},"labels":[],"label_agreement":null},{"id":"W4285412885","doi":"10.3934/dsfe.2022009","title":"The informative value of central banks talks: a topic model application to sentiment analysis","year":2022,"lang":"en","type":"article","venue":"Data Science in Finance and Economics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Index (typography); Predictive power; Latent Dirichlet allocation; Monetary policy; Sentiment analysis; Probit model; Central bank; Topic model; Economics; Computer science; Econometrics; Artificial intelligence; Macroeconomics","score_opus":0.03238549170701941,"score_gpt":0.34087830642507466,"score_spread":0.30849281471805523,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285412885","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5961005,0.0015164658,0.38999802,0.0025669914,0.0002488993,0.00023416682,0.0028649203,0.0007662761,0.005703772],"genre_scores_gemma":[0.9473976,0.0004020865,0.04864738,0.000080493795,0.00024598895,0.00013679366,0.0018596264,0.00007036124,0.0011596641],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987594,0.0007814461,0.00007540008,0.00020603102,0.000105162035,0.00007260683],"domain_scores_gemma":[0.98851085,0.010152217,0.00050210214,0.00024938048,0.0004593064,0.00012606244],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056366436,0.00060505065,0.0006624051,0.0022949008,0.00052521797,0.0019534857,0.0006613223,0.0010009817,0.0025571208],"category_scores_gemma":[0.01590757,0.00027346658,0.0011652496,0.00219474,0.00043644418,0.0016318299,0.00088495796,0.0013092759,0.00045924113],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001376894,0.0005542456,0.12388447,0.00051593257,0.0011514154,0.00053818343,0.0033572004,0.34716523,0.0071143513,0.052834507,0.0143513465,0.4471562],"study_design_scores_gemma":[0.000012829711,0.000025549356,0.0069458564,0.00002197486,0.00003577528,0.000019779893,0.00014889319,0.98351985,0.00024403963,0.0082324045,0.0007803759,0.000012721713],"about_ca_topic_score_codex":0.007920837,"about_ca_topic_score_gemma":0.0061349515,"teacher_disagreement_score":0.007920837,"about_ca_system_score_codex":0.0009843967,"about_ca_system_score_gemma":0.00046809134,"threshold_uncertainty_score":0.029809773},"labels":[],"label_agreement":null},{"id":"W4286749450","doi":"10.31235/osf.io/smjwb","title":"iCoRe: The GDELT Interface for the Advancement of Communication Research","year":2019,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sydney Steel (Canada)","funders":"","keywords":"Computer science; Metadata; Interface (matter); World Wide Web; Data science; Event (particle physics); Data access; Open research; Database","score_opus":0.3613482648232829,"score_gpt":0.5910762556425849,"score_spread":0.229727990819302,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4286749450","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022051374,0.0019433304,0.6736662,0.0052763717,0.0013626239,0.0010235779,0.040723864,0.18053862,0.093260266],"genre_scores_gemma":[0.030662654,0.0027424654,0.7697431,0.0041335616,0.0012981573,0.005259902,0.05943208,0.07156034,0.055167783],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9915172,0.0032119898,0.0010252506,0.0010651326,0.00268853,0.000491992],"domain_scores_gemma":[0.94827646,0.03373135,0.0014729517,0.010462297,0.003986527,0.0020704546],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013547824,0.0021949522,0.0016858547,0.007840221,0.0014279139,0.0114007415,0.0042124046,0.0034940736,0.16122618],"category_scores_gemma":[0.07612426,0.0013085925,0.0021870816,0.008861495,0.0022738122,0.016662953,0.012425354,0.0045379945,0.08440914],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004408805,0.000097805925,0.0010904648,0.0015314603,0.000094810224,0.00031328294,0.0027916522,0.0008103298,0.0027492654,0.1454772,0.61419463,0.23040827],"study_design_scores_gemma":[0.00011936761,0.000031942644,0.00077925355,0.0005696831,0.000029053503,0.00027945396,0.00032278945,0.00446105,0.0019713957,0.076689444,0.9146492,0.000097418306],"about_ca_topic_score_codex":0.0029644025,"about_ca_topic_score_gemma":0.0037432022,"teacher_disagreement_score":0.16122618,"about_ca_system_score_codex":0.0019758663,"about_ca_system_score_gemma":0.0043842867,"threshold_uncertainty_score":0.5393553},"labels":[],"label_agreement":null},{"id":"W4288051737","doi":"10.31235/osf.io/htqs5","title":"What’s a Parent to Do? Measuring Cultural Logics of Parenting with Text Analysis","year":2022,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Parenting styles; Ethnic group; Socioeconomic status; Psychology; Assertiveness; Multinomial logistic regression; Developmental psychology; Social psychology; Race (biology); Class (philosophy); Sociology; Population; Gender studies; Demography","score_opus":0.1601660736796598,"score_gpt":0.41664083963103377,"score_spread":0.256474765951374,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4288051737","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97869474,0.0002805485,0.011954661,0.000968661,0.000029343955,0.00011583291,0.0012031767,0.000032901804,0.0067200284],"genre_scores_gemma":[0.9862367,0.00029489136,0.011556027,0.00014383951,0.000028385737,0.00019549936,0.0009884923,0.000014697523,0.00054143264],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9946911,0.0037777168,0.00036433482,0.0004152755,0.0006261181,0.0001254932],"domain_scores_gemma":[0.92728525,0.060366254,0.0068323007,0.0017187092,0.003176194,0.000621255],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008043221,0.00023376533,0.00021113879,0.0026767256,0.0009536789,0.0023254426,0.00052770117,0.00041006107,0.0016399076],"category_scores_gemma":[0.04656698,0.00013199943,0.00020473829,0.003361618,0.0010489553,0.0030450951,0.0013663702,0.00065611175,0.0002650268],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018041114,0.00021303515,0.6829467,0.0008432959,0.000113523536,0.00035419903,0.14676674,0.0014142381,0.0032621247,0.012295249,0.003437518,0.14817305],"study_design_scores_gemma":[0.000027510192,0.00015917844,0.5626539,0.0009705653,0.0001274459,0.00055662106,0.33431983,0.02362479,0.0055215326,0.03085744,0.041070744,0.00011042248],"about_ca_topic_score_codex":0.00364964,"about_ca_topic_score_gemma":0.005829898,"teacher_disagreement_score":0.008043221,"about_ca_system_score_codex":0.0010330672,"about_ca_system_score_gemma":0.0007531806,"threshold_uncertainty_score":0.042537093},"labels":[],"label_agreement":null},{"id":"W4292819996","doi":"10.1177/14614448221113923","title":"Participatory censorship: How online fandom community facilitates authoritarian rule","year":2022,"lang":"en","type":"article","venue":"New Media & Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":46,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; Concordia University","funders":"","keywords":"Censorship; Authoritarianism; Social media; Sociology; Citizen journalism; Politics; Online community; Public relations; Political science; Media studies; Democracy; Law","score_opus":0.18142143803444236,"score_gpt":0.3824314028423084,"score_spread":0.20100996480786607,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4292819996","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9296966,0.00019955936,0.010816422,0.000875465,0.00006969808,0.000078698504,0.000052984073,0.00012439123,0.058086254],"genre_scores_gemma":[0.9970126,0.000035687346,0.000798957,0.000040350766,0.000013343389,0.000014661431,0.00002171403,0.000015392648,0.0020471963],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9981343,0.0010825859,0.00005310239,0.00026449852,0.00023881096,0.00022678453],"domain_scores_gemma":[0.9927757,0.0039239693,0.0011771823,0.00080536806,0.00049285847,0.00082496],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002252741,0.00030155617,0.00023345905,0.0010232574,0.0031458237,0.0039616586,0.0006658819,0.000584429,0.0061324686],"category_scores_gemma":[0.010594694,0.0001742123,0.00026466345,0.0005825668,0.0035840655,0.0035643396,0.0029531717,0.00083884026,0.00054803636],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050687784,0.00058338937,0.18596958,0.00045309364,0.00008247302,0.0026426865,0.52498597,0.0012643439,0.012554032,0.0960454,0.006509014,0.16840316],"study_design_scores_gemma":[0.00018545524,0.0007286282,0.24481602,0.0005222863,0.00020366281,0.0021045306,0.41653547,0.026644679,0.0093522165,0.12438662,0.17433104,0.00018937426],"about_ca_topic_score_codex":0.0025175703,"about_ca_topic_score_gemma":0.0039824024,"teacher_disagreement_score":0.0061324686,"about_ca_system_score_codex":0.00068485143,"about_ca_system_score_gemma":0.0010260488,"threshold_uncertainty_score":0.020515084},"labels":[],"label_agreement":null},{"id":"W4293729198","doi":"10.1155/2022/6880310","title":"Development of Risk-Situation Scenario for Autonomous Vehicles on Expressway Using Topic Modeling","year":2022,"lang":"en","type":"article","venue":"Journal of Advanced Transportation","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Ministry of Science and ICT, South Korea; Ministry of Science, ICT and Future Planning","keywords":"Accident (philosophy); Transport engineering; Traffic accident; Computer science; Risk analysis (engineering); Engineering; Business","score_opus":0.059662931721540996,"score_gpt":0.35783993332943936,"score_spread":0.2981770016078984,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4293729198","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5001884,0.00046153544,0.48211873,0.0010863097,0.000084402316,0.00092423015,0.0054276763,0.0019267746,0.007781919],"genre_scores_gemma":[0.8157858,0.0002847597,0.17691693,0.000037814494,0.000023434117,0.0005528901,0.005389053,0.000059553946,0.0009496925],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991003,0.00035230728,0.00008703941,0.000230592,0.00014860151,0.00008104342],"domain_scores_gemma":[0.99834204,0.0010663995,0.00017400684,0.0000823612,0.00023393528,0.000101256745],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001469802,0.00090143346,0.00039762928,0.0031525702,0.000601661,0.0012937216,0.00091476314,0.0009143841,0.0016470491],"category_scores_gemma":[0.004262159,0.00039443834,0.0015248742,0.0013117709,0.00028852088,0.002229535,0.00092739204,0.000660874,0.00030085605],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004133581,0.0004563088,0.061398048,0.00068739156,0.0004080492,0.0021156226,0.0037297031,0.760566,0.007525493,0.032437146,0.0069125006,0.123350434],"study_design_scores_gemma":[0.000014349421,0.0000447159,0.0036650728,0.000024250112,0.000057762027,0.00012478133,0.00076909683,0.9850301,0.0010831765,0.0069379746,0.0022248644,0.000023842544],"about_ca_topic_score_codex":0.011189148,"about_ca_topic_score_gemma":0.011184933,"teacher_disagreement_score":0.011189148,"about_ca_system_score_codex":0.0012803851,"about_ca_system_score_gemma":0.0012796762,"threshold_uncertainty_score":0.02224809},"labels":[],"label_agreement":null},{"id":"W4294096126","doi":"10.22230/cjc.2022v47n2a4207","title":"Deciphering the Decline: A Computational Analysis of Two Decades of Canadian Newspaper Op-Eds on Freedom of Information","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Communication","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Newspaper; Publication; Politics; Frame (networking); DECIPHER; Period (music); Content analysis; Freedom of the press; Media studies; Political science; Sociology; Computer science; Social science; Law; Telecommunications","score_opus":0.037637512752544414,"score_gpt":0.33922022676132946,"score_spread":0.30158271400878506,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4294096126","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97938526,0.0009571148,0.00092010986,0.002001424,0.00003472471,0.000057050693,0.009132704,0.00006241228,0.0074492376],"genre_scores_gemma":[0.9754537,0.00059153046,0.0024116922,0.00021806022,0.000037453785,0.00005675939,0.018214602,0.00004794219,0.0029682089],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99930584,0.00014968628,0.000026844209,0.00014313955,0.00021298644,0.00016149638],"domain_scores_gemma":[0.99248827,0.0043240273,0.0006891092,0.0003783501,0.0017082086,0.00041204665],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014474419,0.0004338438,0.00059355935,0.004249205,0.004256096,0.0026466262,0.0014320401,0.00085723144,0.0028152165],"category_scores_gemma":[0.012952939,0.00027116627,0.000515004,0.01162657,0.001686807,0.0013439347,0.0010810853,0.0011329164,0.00038285082],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012251731,0.0006212616,0.59841555,0.0011013837,0.00066684315,0.0029336216,0.054569293,0.05607334,0.0031282462,0.02930834,0.091297165,0.16065991],"study_design_scores_gemma":[0.00007554716,0.000082234896,0.73993534,0.00022931144,0.00023968001,0.00031859503,0.047694944,0.1306966,0.0010791647,0.0059769857,0.07350692,0.00016471316],"about_ca_topic_score_codex":0.97258186,"about_ca_topic_score_gemma":0.98214346,"teacher_disagreement_score":0.027418137,"about_ca_system_score_codex":0.01881167,"about_ca_system_score_gemma":0.0103380615,"threshold_uncertainty_score":0.13648885},"labels":[],"label_agreement":null},{"id":"W4294577736","doi":"10.1108/s0733-558x20220000082001","title":"Introduction – “Reversing Entrepreneurship’s Arrow”: The Metaphor’s Model and Research Implications","year":2022,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Reversing; Arrow; Metaphor; Entrepreneurship; Arrow of time; Epistemology; Sociology; Political science; Philosophy; Computer science; Linguistics; Engineering; Physics; Mechanical engineering; Law; Quantum mechanics","score_opus":0.17482171515315892,"score_gpt":0.42146620256132883,"score_spread":0.2466444874081699,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4294577736","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0075135105,0.02460342,0.097699076,0.13169251,0.009738558,0.00011648483,0.0008777069,0.00045253272,0.7273062],"genre_scores_gemma":[0.43443164,0.035302654,0.09082087,0.030037262,0.013187248,0.00049241865,0.0012784952,0.00090359576,0.39354584],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9993882,0.00031091366,0.000022355533,0.00010657419,0.00013674014,0.00003509781],"domain_scores_gemma":[0.99756503,0.0019145118,0.00008509642,0.000114974384,0.00022739283,0.000092958086],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012558228,0.00055931206,0.00033582473,0.0014940817,0.0015257507,0.003993784,0.0010420072,0.0021896053,0.030257413],"category_scores_gemma":[0.0043882285,0.00023594878,0.00043511903,0.0021882963,0.0052591283,0.0093158325,0.001314133,0.0039253044,0.005419256],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006193706,0.000009575815,0.000060088765,0.000056200228,0.0000017093145,0.00003071933,0.00076260726,0.0000990037,0.000094528215,0.9445632,0.04125965,0.013056557],"study_design_scores_gemma":[0.0000037392235,0.000010091591,0.00026717395,0.00019457554,0.0000035043638,0.00020972543,0.0007836543,0.00080315745,0.0002426113,0.6783597,0.3191095,0.000012628332],"about_ca_topic_score_codex":0.0016256387,"about_ca_topic_score_gemma":0.0017134756,"teacher_disagreement_score":0.030257413,"about_ca_system_score_codex":0.0012440586,"about_ca_system_score_gemma":0.0012060262,"threshold_uncertainty_score":0.101221085},"labels":[],"label_agreement":null},{"id":"W4295074070","doi":"10.11144/javeriana.uh90.mmfc","title":"Una metodología para modelar fenómenos culturales latentes: interés público en la red Razón Pública","year":2022,"lang":"es","type":"article","venue":"Universitas Humanística","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Humanities; Philosophy","score_opus":0.04926616308489918,"score_gpt":0.35252636813133365,"score_spread":0.3032602050464345,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4295074070","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043626472,0.0011569848,0.93392056,0.004114018,0.0002113871,0.0002640714,0.0014222338,0.00046901946,0.01481519],"genre_scores_gemma":[0.66895145,0.0014662965,0.311009,0.00048468242,0.00027982198,0.0012776459,0.0013600452,0.00027471452,0.014896296],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9946144,0.0033729952,0.00026629315,0.0009777078,0.0005545616,0.0002140193],"domain_scores_gemma":[0.988059,0.008361107,0.00092800637,0.0014407643,0.00092285045,0.00028826183],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007118345,0.0010350489,0.00093453645,0.0031425178,0.001729686,0.008402812,0.0018596947,0.0017335833,0.008619524],"category_scores_gemma":[0.02111838,0.0006952215,0.0018130151,0.0033197086,0.002695293,0.007045965,0.0030052888,0.0030476307,0.0010092792],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021463563,0.00021187322,0.03357254,0.00065877545,0.0004026902,0.00032544826,0.009608516,0.041538138,0.0018721664,0.7146179,0.0062705087,0.19070683],"study_design_scores_gemma":[0.00007517235,0.00016117738,0.01232572,0.0005465816,0.00028059105,0.00032789062,0.007746688,0.34978896,0.0023890715,0.5516022,0.074616924,0.00013907722],"about_ca_topic_score_codex":0.016303334,"about_ca_topic_score_gemma":0.019411772,"teacher_disagreement_score":0.016303334,"about_ca_system_score_codex":0.003923919,"about_ca_system_score_gemma":0.0044228085,"threshold_uncertainty_score":0.037645876},"labels":[],"label_agreement":null},{"id":"W4296353126","doi":"10.20944/preprints202209.0259.v1","title":"Social Media Platforms: Trading with Prediction Error Minimization for Your Attention","year":2022,"lang":"en","type":"preprint","venue":"Preprints.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Affordance; Social media; Salient; Salience (neuroscience); Inference; Computer science; Internet privacy; Human–computer interaction; Cognitive science; Cognitive psychology; Psychology; Artificial intelligence; World Wide Web","score_opus":0.30973752454821435,"score_gpt":0.44395421595301093,"score_spread":0.13421669140479658,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4296353126","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19503899,0.0020021135,0.77490956,0.0089939,0.00033764844,0.00047624987,0.0001770206,0.0015039119,0.016560633],"genre_scores_gemma":[0.8573601,0.0003851655,0.13735601,0.0005773622,0.000335446,0.00024947088,0.000080917525,0.00023389491,0.0034214999],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9934141,0.0033778877,0.00027285595,0.0014803299,0.0010189379,0.00043592716],"domain_scores_gemma":[0.9265793,0.062351868,0.0029615674,0.005035156,0.0018580919,0.0012140023],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012967334,0.0017855479,0.0019950895,0.001324553,0.0011774455,0.0038087994,0.0035744742,0.0038730209,0.0066971383],"category_scores_gemma":[0.06707968,0.0012010118,0.0010730308,0.0010366964,0.0024713413,0.009048113,0.004911291,0.003686728,0.00083524146],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029824933,0.0012767874,0.019550996,0.0006755677,0.00064800895,0.00071037025,0.0024868078,0.24432911,0.012487234,0.14344278,0.007193161,0.5642167],"study_design_scores_gemma":[0.00012098964,0.00048309352,0.0026108427,0.00007047619,0.0001340832,0.00018120205,0.00018837611,0.862671,0.0026389535,0.1290336,0.0018092646,0.00005815109],"about_ca_topic_score_codex":0.0038452332,"about_ca_topic_score_gemma":0.003470138,"teacher_disagreement_score":0.012967334,"about_ca_system_score_codex":0.0018903995,"about_ca_system_score_gemma":0.0019623674,"threshold_uncertainty_score":0.06857866},"labels":[],"label_agreement":null},{"id":"W4302307740","doi":"10.3138/cjc.2022-06-30","title":"<b>AI for Everyone? Critical Perspectives</b> . <i>Edited by Pieter Verdegem</i>","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Communication","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Sociology; Philosophy; Art","score_opus":0.030105218768151264,"score_gpt":0.36949512427677766,"score_spread":0.3393899055086264,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4302307740","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007673545,0.35557106,0.004258268,0.49850523,0.10211077,0.000110965004,0.00048695123,0.00015125779,0.038038146],"genre_scores_gemma":[0.06069875,0.43274894,0.017729353,0.14990847,0.09479393,0.0011945275,0.0012558905,0.001097835,0.24057235],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99097824,0.006386689,0.00024088082,0.0005934281,0.0015397278,0.00026103217],"domain_scores_gemma":[0.9551257,0.031013234,0.0015662429,0.0009136702,0.009465943,0.0019151835],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010884823,0.0012002878,0.0007145787,0.0033411537,0.006455493,0.008926367,0.001661454,0.00359384,0.011063267],"category_scores_gemma":[0.04266445,0.0005015731,0.00047723026,0.0029016675,0.0099625345,0.0074856137,0.0036590137,0.0070624608,0.0040791994],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000009286716,0.000004509023,0.000051578034,0.00023513888,0.000004977068,0.0000387185,0.0031268077,0.000027054988,0.000050016897,0.017297547,0.9551053,0.024049057],"study_design_scores_gemma":[0.000004186448,0.0000058839005,0.0003442798,0.0013588,0.000004950528,0.00014245247,0.0047934074,0.00007133613,0.000093759285,0.02116375,0.97199774,0.000019548263],"about_ca_topic_score_codex":0.024679914,"about_ca_topic_score_gemma":0.043865,"teacher_disagreement_score":0.024679914,"about_ca_system_score_codex":0.0056365393,"about_ca_system_score_gemma":0.014355545,"threshold_uncertainty_score":0.057565153},"labels":[],"label_agreement":null},{"id":"W4304188761","doi":"10.1515/9781845457822-014","title":"APPENDIX Native News Networks of Canada (NNNC) Statement of Principles","year":2022,"lang":"en","type":"book-chapter","venue":"Berghahn Books","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Statement (logic); Political science; Computer science; Law","score_opus":0.05015907816484344,"score_gpt":0.3116187391185105,"score_spread":0.2614596609536671,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4304188761","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007010906,0.0012772991,0.002846089,0.0065640896,0.0029101025,0.0003764586,0.08222765,0.0013997515,0.90169746],"genre_scores_gemma":[0.012029071,0.00229848,0.007351853,0.002124036,0.0005649805,0.00043725644,0.03923633,0.0009794089,0.93497854],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99729913,0.00016338904,0.00008585857,0.0002794954,0.0017502006,0.00042185106],"domain_scores_gemma":[0.98830926,0.0008065867,0.000212279,0.00042918115,0.009400036,0.00084264996],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0017001097,0.0008450526,0.00072064984,0.0061643305,0.005062832,0.009690549,0.0017598734,0.0017961937,0.35835487],"category_scores_gemma":[0.012794439,0.0007643728,0.00046883614,0.008874458,0.0010901225,0.002632619,0.0018719112,0.0015853401,0.13850397],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000065727345,0.000005133194,0.00017023884,0.000054870634,0.0000013396472,0.000020528058,0.00007213751,0.00011759689,0.000024928844,0.02287269,0.96684074,0.0098131625],"study_design_scores_gemma":[0.0000028682534,0.0000012235396,0.0004593326,0.00008854695,0.0000024507938,0.00002033269,0.00014729853,0.00010744039,0.000068720816,0.0026268682,0.9964637,0.000011297501],"about_ca_topic_score_codex":0.8659098,"about_ca_topic_score_gemma":0.8801367,"teacher_disagreement_score":0.35835487,"about_ca_system_score_codex":0.028604032,"about_ca_system_score_gemma":0.049136627,"threshold_uncertainty_score":0.9152289},"labels":[],"label_agreement":null},{"id":"W4306178485","doi":"10.3233/jid-220013","title":"Natural language processing (NLP) aided qualitative method in health research","year":2022,"lang":"en","type":"article","venue":"Journal of Integrated Design and Process Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Mount Royal University; Alberta Health Services; Concordia University; University of Calgary","funders":"","keywords":"Computer science; Natural language processing; Sentence; Cluster analysis; Artificial intelligence; Workload; Context (archaeology); Automatic summarization; Qualitative research; Information retrieval; Text mining; Data science; Data mining","score_opus":0.2305358605394815,"score_gpt":0.5988821724556453,"score_spread":0.36834631191616385,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4306178485","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007187231,0.00046884757,0.96092963,0.0017466213,0.000257083,0.018977603,0.0021297836,0.00076746277,0.007535836],"genre_scores_gemma":[0.02134573,0.00024766652,0.9378156,0.00042292004,0.00004380371,0.0383817,0.00040891214,0.00019762537,0.0011359516],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.81645644,0.16135676,0.008239961,0.0064930324,0.006437418,0.0010163662],"domain_scores_gemma":[0.7082444,0.24387507,0.009711579,0.01739353,0.019704226,0.0010711976],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13395587,0.001729705,0.0018341839,0.007627744,0.00392189,0.0060503227,0.004004781,0.0017929572,0.021239193],"category_scores_gemma":[0.17441368,0.0015656875,0.0016154536,0.009767845,0.006934411,0.004672901,0.0072531095,0.004084722,0.004616252],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001228031,0.000594031,0.0035644886,0.02351106,0.00027828984,0.0014102445,0.1663933,0.010054329,0.021355521,0.21563429,0.026389422,0.529587],"study_design_scores_gemma":[0.0011092816,0.0007313686,0.006233791,0.009975049,0.00028215803,0.0010242978,0.07001269,0.06577872,0.03129664,0.43012464,0.3826133,0.00081798044],"about_ca_topic_score_codex":0.005084215,"about_ca_topic_score_gemma":0.0087993685,"teacher_disagreement_score":0.13395587,"about_ca_system_score_codex":0.0063106082,"about_ca_system_score_gemma":0.0199154,"threshold_uncertainty_score":0.7084348},"labels":[],"label_agreement":null},{"id":"W4306730885","doi":"10.2196/37945","title":"The Real-World Experiences of Persons With Multiple Sclerosis During the First COVID-19 Lockdown: Application of Natural Language Processing","year":2022,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Schweizerische Multiple Sklerose Gesellschaft; Universität Zürich; Multiple Sclerosis Society","keywords":"Computer science; Data science; Python (programming language); Natural language processing; Pipeline (software); Artificial intelligence; Scale (ratio); Information retrieval","score_opus":0.026005924106528765,"score_gpt":0.35340319423365596,"score_spread":0.3273972701271272,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4306730885","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.92947125,0.00050746015,0.039231207,0.0014132567,0.00006620545,0.0024062626,0.019566076,0.001263651,0.0060746185],"genre_scores_gemma":[0.8710852,0.00062376604,0.10726842,0.0004201704,0.000059130234,0.0048902486,0.013108138,0.00039420364,0.0021507915],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9950677,0.0031155513,0.00040824423,0.0006739124,0.0005031293,0.00023146914],"domain_scores_gemma":[0.94060946,0.050224338,0.003960266,0.0017074143,0.0027091524,0.00078939873],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007108002,0.00054040086,0.00037579722,0.0034559926,0.001196811,0.0019164225,0.0009930704,0.0007281955,0.0046052113],"category_scores_gemma":[0.035110116,0.00029735654,0.0005892116,0.0030419827,0.0012612069,0.0019814689,0.0036523528,0.0009478299,0.0013944448],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010233487,0.00044848028,0.09823546,0.0057504703,0.00010125689,0.004520536,0.6374176,0.0025660293,0.014355883,0.0017375312,0.014380335,0.21946302],"study_design_scores_gemma":[0.00016369134,0.0008435604,0.38118398,0.002634519,0.00018374137,0.0019557409,0.47074577,0.01925911,0.01798396,0.009432971,0.095184214,0.00042864805],"about_ca_topic_score_codex":0.0055317585,"about_ca_topic_score_gemma":0.009494153,"teacher_disagreement_score":0.007108002,"about_ca_system_score_codex":0.0013570162,"about_ca_system_score_gemma":0.0017567405,"threshold_uncertainty_score":0.03759116},"labels":[],"label_agreement":null},{"id":"W4306810344","doi":"10.21203/rs.3.rs-2177585/v1","title":"Medical Informatics Research across 20 Years in China: A Structural Topic Modeling-based Analysis of Master’s Theses","year":2022,"lang":"en","type":"preprint","venue":"Research Square","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"China; Informatics; Health informatics; Data science; Computer science; Regional science; Library science; Political science; Sociology","score_opus":0.23516696811651752,"score_gpt":0.5632592708682641,"score_spread":0.3280923027517466,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4306810344","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99440306,0.000757345,0.00089196075,0.0005103737,0.000021977154,0.000105335625,0.0016816972,0.000024380699,0.0016038582],"genre_scores_gemma":[0.99706227,0.0003399145,0.00041325655,0.000031584488,0.00003868318,0.00011421608,0.0015170685,0.000006551286,0.00047647647],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9951402,0.0011129697,0.0007674157,0.00078373094,0.0014699902,0.0007256923],"domain_scores_gemma":[0.96697456,0.016796974,0.0073995553,0.0013677571,0.004803869,0.0026572237],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.009558103,0.0005829972,0.0010869094,0.013789255,0.0015880187,0.0029138015,0.0010630413,0.00065306295,0.0030643751],"category_scores_gemma":[0.022643317,0.00032560903,0.0017864737,0.019717852,0.00085840357,0.0018181205,0.0022011267,0.00083786325,0.00037325046],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005251378,0.0000801528,0.97440493,0.00023026696,0.00016650248,0.00015864824,0.0071756756,0.0008995362,0.0001482417,0.00077933876,0.0010424096,0.014861767],"study_design_scores_gemma":[0.000009570284,0.00006959739,0.98281544,0.00009657997,0.000100871024,0.000048484653,0.0070516407,0.0066849124,0.000110994224,0.0004018538,0.0025938863,0.000016063766],"about_ca_topic_score_codex":0.038613357,"about_ca_topic_score_gemma":0.02122252,"teacher_disagreement_score":0.9904419,"about_ca_system_score_codex":0.0041251318,"about_ca_system_score_gemma":0.006309929,"threshold_uncertainty_score":0.07677716},"labels":[],"label_agreement":null},{"id":"W4306855756","doi":"10.1126/sciadv.ade6585","title":"Causal inference from text: A commentary","year":2022,"lang":"en","type":"review","venue":"Science Advances","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Causal inference; Statistical inference; Inference; Computer science; Data science; Artificial intelligence; Causal model; Natural language processing; Cognitive science; Psychology; Econometrics; Mathematics; Statistics","score_opus":0.12007224181700256,"score_gpt":0.4976705888656102,"score_spread":0.3775983470486077,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4306855756","genre_codex":"review","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000051799558,0.507862,0.0013850487,0.4605168,0.028934589,0.00003194308,0.00026393263,0.00003148704,0.0009223119],"genre_scores_gemma":[0.0033967495,0.40795416,0.0019644005,0.51516217,0.069426574,0.00029259128,0.00018528219,0.00009225022,0.0015258479],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96090585,0.019062499,0.0047477367,0.0043196734,0.010461914,0.00050242385],"domain_scores_gemma":[0.5665287,0.39092508,0.006618686,0.0041908147,0.030000174,0.0017365376],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0645518,0.0019114371,0.0050579174,0.008905931,0.0022003278,0.006512329,0.0073843338,0.02032675,0.0052629486],"category_scores_gemma":[0.2583409,0.0016989982,0.0039888723,0.008654575,0.014314191,0.012071674,0.0040566763,0.04394471,0.004341607],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014745606,0.000015457543,0.000131652,0.013454944,0.000663814,0.00019040893,0.0005142265,0.00015166948,0.00013834338,0.05024031,0.84844476,0.08590693],"study_design_scores_gemma":[0.00021764025,0.000040933737,0.00056606065,0.036237787,0.0006982337,0.0004622077,0.0002363896,0.00023923654,0.00027684888,0.057389088,0.9035262,0.00010934563],"about_ca_topic_score_codex":0.016500637,"about_ca_topic_score_gemma":0.016581845,"teacher_disagreement_score":0.0645518,"about_ca_system_score_codex":0.01010572,"about_ca_system_score_gemma":0.01891262,"threshold_uncertainty_score":0.34138662},"labels":[],"label_agreement":null},{"id":"W4307702850","doi":"10.3389/ijph.2022.1605241","title":"Topic Modelling and Sentiment Analysis of Tweets Related to Freedom Convoy 2022 in Canada","year":2022,"lang":"en","type":"article","venue":"International Journal of Public Health","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Public Health Ontario; University of Waterloo","funders":"","keywords":"Sentiment analysis; Politics; Topic model; Computer science; Psychology; Political science; Data science; Artificial intelligence; Law","score_opus":0.06483425278233088,"score_gpt":0.38982729841741404,"score_spread":0.32499304563508313,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4307702850","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9755459,0.00041559915,0.0027546384,0.0010568085,0.00005662774,0.00014319162,0.013093631,0.00010165879,0.0068319454],"genre_scores_gemma":[0.9851697,0.000357449,0.0026612491,0.00007335989,0.000040953382,0.00009626528,0.008175057,0.000023283405,0.0034025856],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9993728,0.00010470398,0.000036522688,0.00009207564,0.0002578489,0.00013613013],"domain_scores_gemma":[0.9971596,0.000831221,0.00034767628,0.000071848044,0.0014192057,0.00017045994],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010133934,0.00029132477,0.00024957495,0.0018485722,0.0016567957,0.001478107,0.00032961086,0.00025467062,0.0010008819],"category_scores_gemma":[0.0044473787,0.000105648665,0.00034160021,0.0029120897,0.000455723,0.00049842184,0.0005025975,0.0005267464,0.0002593963],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010317394,0.0001579342,0.797672,0.0008872649,0.00021533277,0.0011440011,0.035771836,0.008284558,0.017747728,0.0037907825,0.03168014,0.10161668],"study_design_scores_gemma":[0.0000141894525,0.000053864667,0.8960865,0.00014159262,0.000096907774,0.0001258412,0.027104212,0.03606736,0.003932804,0.00062537077,0.035677884,0.00007348433],"about_ca_topic_score_codex":0.83075243,"about_ca_topic_score_gemma":0.87147015,"teacher_disagreement_score":0.16924757,"about_ca_system_score_codex":0.0073569827,"about_ca_system_score_gemma":0.008767216,"threshold_uncertainty_score":0.34048855},"labels":[],"label_agreement":null},{"id":"W4309221281","doi":"10.21203/rs.3.rs-2260181/v1","title":"Large Scale Genealogical Information Extraction From Handwritten Quebec Parish Records","year":2022,"lang":"en","type":"preprint","venue":"Research Square","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université du Québec à Chicoutimi","funders":"Association Nationale de la Recherche et de la Technologie","keywords":"Workflow; Computer science; Consistency (knowledge bases); Scale (ratio); Sample (material); Information extraction; Artificial intelligence; Population; Natural language processing; Information retrieval; Database; Data mining; Geography; Cartography; Medicine","score_opus":0.1050366162942268,"score_gpt":0.4819845324814767,"score_spread":0.37694791618724993,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4309221281","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3858991,0.0028168794,0.27902085,0.0017824061,0.0002572962,0.0022194793,0.2473726,0.047892563,0.032738883],"genre_scores_gemma":[0.3601589,0.0009985087,0.39211208,0.00020217072,0.000088811394,0.0007466423,0.20415065,0.0012223289,0.04031989],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992261,0.000070444854,0.000049299397,0.00024195996,0.00030483754,0.00010742112],"domain_scores_gemma":[0.99725646,0.0007073225,0.00019602088,0.00037981663,0.0013266237,0.00013379194],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00053087017,0.0008749057,0.0005146759,0.008809743,0.0014382271,0.0021655024,0.0008486236,0.0005930578,0.007358922],"category_scores_gemma":[0.003309823,0.00028276857,0.0005029967,0.0054225386,0.00047692918,0.0005403198,0.0006990293,0.00040968033,0.0038165636],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033440787,0.0001533686,0.03765109,0.0009795934,0.00018540338,0.0025855717,0.002689046,0.012940631,0.047520205,0.0031426682,0.09737046,0.79444754],"study_design_scores_gemma":[0.000082189,0.00010550277,0.28971392,0.000557541,0.00018474879,0.0012255793,0.004346179,0.20242484,0.084939815,0.0045301206,0.41163167,0.00025785732],"about_ca_topic_score_codex":0.60581183,"about_ca_topic_score_gemma":0.68097305,"teacher_disagreement_score":0.39418817,"about_ca_system_score_codex":0.0033374971,"about_ca_system_score_gemma":0.0065657077,"threshold_uncertainty_score":0.79301924},"labels":[],"label_agreement":null},{"id":"W4309271228","doi":"10.31235/osf.io/tc2yn","title":"Beyond protests: Using computational text analysis to explore a greater variety of social movement activities","year":2022,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Newspaper; Social movement; Movement (music); Variety (cybernetics); Focus (optics); Social media; Political science; Sociology; Data science; Public relations; Media studies; Computer science; Politics; Artificial intelligence","score_opus":0.12417378833936625,"score_gpt":0.4129133302441062,"score_spread":0.28873954190473994,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4309271228","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.33228216,0.0053343526,0.5994178,0.012540829,0.0006759214,0.001401459,0.019911258,0.002755606,0.02568059],"genre_scores_gemma":[0.5402907,0.0012527683,0.43740264,0.0012536742,0.00072915654,0.0014913278,0.014736818,0.0002637811,0.002579065],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9894555,0.0070100087,0.0007415347,0.0013749357,0.0011886942,0.00022920338],"domain_scores_gemma":[0.8982549,0.089522645,0.0053331684,0.004127645,0.002112133,0.00064957753],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008046574,0.0015122491,0.0010885419,0.020577025,0.0016749797,0.008328804,0.0022830127,0.001876917,0.0030999726],"category_scores_gemma":[0.050053135,0.00045644664,0.001952902,0.01617579,0.002351108,0.009642811,0.0031859358,0.0024736759,0.0012246029],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058160117,0.0013705214,0.12364872,0.003512307,0.0012693116,0.002136112,0.033271752,0.06443457,0.0065062083,0.124590226,0.0276039,0.61107475],"study_design_scores_gemma":[0.00008275855,0.00015590951,0.04417982,0.0006849174,0.00019818239,0.00066130573,0.015410458,0.5845164,0.0029414515,0.30385014,0.047058705,0.00025993682],"about_ca_topic_score_codex":0.008582291,"about_ca_topic_score_gemma":0.010728774,"teacher_disagreement_score":0.020577025,"about_ca_system_score_codex":0.0018567682,"about_ca_system_score_gemma":0.0015261379,"threshold_uncertainty_score":0.042554796},"labels":[],"label_agreement":null},{"id":"W4309985496","doi":"10.5264/foo.bar","title":"Watch Laval vs Saskatchewan Live Free HS Football Game 25rd Nov 2022","year":2022,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Football; Aeronautics; Engineering; Geography; Archaeology","score_opus":0.038527032819602215,"score_gpt":0.29245554823614034,"score_spread":0.2539285154165381,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4309985496","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038794987,0.000591885,0.00026701076,0.0024098018,0.0061921068,0.00024999946,0.013579629,0.0012078576,0.9716223],"genre_scores_gemma":[0.006844299,0.00039225223,0.0002973195,0.001128481,0.0002412909,0.000097472104,0.0047100103,0.00029793175,0.98599094],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996377,0.00002319934,0.000008605009,0.000052561274,0.000121855184,0.00015604135],"domain_scores_gemma":[0.9993679,0.000019663614,0.000010932214,0.000026880845,0.0002734305,0.00030124636],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.00038531775,0.0012764528,0.00054509396,0.0010917936,0.0045263064,0.0034138998,0.0009478813,0.0013532193,0.631933],"category_scores_gemma":[0.0007051038,0.0004150684,0.00047139157,0.0008195166,0.00054313045,0.001329508,0.0027309123,0.0023928052,0.3414693],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011387965,0.00005074536,0.0005008294,0.000050738927,0.000004911193,0.000091517955,0.000069512134,0.000035831497,0.00037444537,0.0004306467,0.987283,0.010993887],"study_design_scores_gemma":[0.000044320415,0.000034872595,0.004923977,0.00011462551,0.0000053338886,0.0000295768,0.00053024996,0.00006897738,0.00029419028,0.00014379412,0.99379,0.000020230946],"about_ca_topic_score_codex":0.32088593,"about_ca_topic_score_gemma":0.8117021,"teacher_disagreement_score":0.36806703,"about_ca_system_score_codex":0.004566736,"about_ca_system_score_gemma":0.004108294,"threshold_uncertainty_score":0.6380363},"labels":[],"label_agreement":null},{"id":"W4310576792","doi":"10.1177/00491241221123088","title":"From Ends to Means: The Promise of Computational Text Analysis for Theoretically Driven Sociological Research","year":2022,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Skepticism; Field (mathematics); Relevance (law); Management science; Set (abstract data type); Computational model; Epistemology; Selection (genetic algorithm); Computational sociology; Data science; Process (computing); Sociology; Artificial intelligence; Political science","score_opus":0.4486729254285306,"score_gpt":0.6277772920025255,"score_spread":0.17910436657399492,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4310576792","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011102605,0.009592866,0.8501857,0.07957366,0.0016229433,0.00039654906,0.00065047166,0.00069727143,0.046177976],"genre_scores_gemma":[0.19834,0.009189635,0.7763157,0.005223824,0.002626496,0.0016614893,0.00078656094,0.0008063406,0.0050499444],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95196974,0.040012028,0.0012314615,0.0018979963,0.004534476,0.00035429272],"domain_scores_gemma":[0.64211494,0.3278784,0.0047164178,0.019193154,0.0045806016,0.0015165875],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.047725327,0.0013305816,0.0015621479,0.0073650302,0.004788702,0.025126962,0.004063154,0.0039947266,0.010974203],"category_scores_gemma":[0.15378138,0.00093454885,0.0015108688,0.0062463507,0.024531906,0.046403423,0.011692276,0.0089667225,0.0025589485],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000059551734,0.000041083505,0.0010593919,0.000638399,0.000059514263,0.00009275677,0.00741728,0.0015776976,0.0003419457,0.9248182,0.009976122,0.053918023],"study_design_scores_gemma":[0.000011334026,0.000009916401,0.00019881793,0.00033727774,0.000010117686,0.00006134162,0.0015065928,0.0053248443,0.00026545348,0.9622685,0.029972503,0.000033450116],"about_ca_topic_score_codex":0.0011731811,"about_ca_topic_score_gemma":0.0020033324,"teacher_disagreement_score":0.9522747,"about_ca_system_score_codex":0.003286366,"about_ca_system_score_gemma":0.005334416,"threshold_uncertainty_score":0.25239873},"labels":[],"label_agreement":null},{"id":"W4311241838","doi":"10.2196/41198","title":"Unmasking the Twitter Discourses on Masks During the COVID-19 Pandemic: User Cluster–Based BERT Topic Modeling Approach","year":2022,"lang":"en","type":"article","venue":"JMIR Infodemiology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Waterloo; University of British Columbia; Dalhousie University; Université Laval; Institut National de Santé Publique du Québec; Centre hospitalier universitaire de Québec; Université de Sherbrooke","funders":"","keywords":"Context (archaeology); Social media; Politics; Public health; Political science; Salient; Identity (music); Sociology; Public relations; World Wide Web; Computer science; Geography; Medicine; Law","score_opus":0.1671066051381052,"score_gpt":0.4412386824298929,"score_spread":0.2741320772917877,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4311241838","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8025978,0.0005940673,0.18260735,0.0027614937,0.000057167326,0.0004247033,0.0022789722,0.0003031966,0.0083750645],"genre_scores_gemma":[0.96918744,0.00013506487,0.028261274,0.00006912927,0.00003610694,0.0002180846,0.0009124295,0.0000320425,0.0011484384],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978854,0.0013122503,0.000059452148,0.0004260123,0.00015028538,0.00016663529],"domain_scores_gemma":[0.9898589,0.008572848,0.0005577046,0.0004207383,0.00036820228,0.00022165684],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004602019,0.0006005115,0.0005496785,0.0032614123,0.0013165585,0.0025377402,0.0010838974,0.0011161041,0.0023519213],"category_scores_gemma":[0.009358498,0.0004332404,0.00097158446,0.0023892722,0.0014653528,0.002883516,0.0019952965,0.0011770396,0.00050532987],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018525278,0.0007236824,0.417575,0.00091697945,0.0006065606,0.001165768,0.12343217,0.110694766,0.010131426,0.13655137,0.008306542,0.1880433],"study_design_scores_gemma":[0.000023693192,0.000114756665,0.06457206,0.00010659613,0.00009743378,0.0001542474,0.021548059,0.8743093,0.0012689063,0.02972624,0.007991703,0.00008693736],"about_ca_topic_score_codex":0.02121855,"about_ca_topic_score_gemma":0.022978831,"teacher_disagreement_score":0.02121855,"about_ca_system_score_codex":0.0023049333,"about_ca_system_score_gemma":0.0011696679,"threshold_uncertainty_score":0.042190075},"labels":[],"label_agreement":null},{"id":"W4311978792","doi":"10.3233/faia220454","title":"Why Do Tenants Sue Their Landlords? Answers from a Topic Model","year":2022,"lang":"en","type":"book-chapter","venue":"Frontiers in artificial intelligence and applications","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Research Unit on Children's Psychosocial Maladjustment; Université de Montréal","funders":"Université de Montréal","keywords":"Terminology; Landlord; Computer science; Embedding; Domain (mathematical analysis); Operations research; Data science; Artificial intelligence; Linguistics; Political science; Law; Engineering; Mathematics","score_opus":0.07599100723899838,"score_gpt":0.3350265020685014,"score_spread":0.259035494829503,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4311978792","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16867475,0.034275334,0.55552053,0.17009377,0.001253843,0.00020833994,0.00760078,0.00077119056,0.06160153],"genre_scores_gemma":[0.896485,0.010760799,0.0685598,0.0034307602,0.002847905,0.00022056983,0.005499402,0.00015787546,0.01203794],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9987179,0.00083815464,0.00006381433,0.00020500312,0.00011602654,0.000059072267],"domain_scores_gemma":[0.9788887,0.019191101,0.00058205286,0.00041445784,0.00061531377,0.00030844586],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003701454,0.00053207483,0.00079788594,0.0012487045,0.00081896153,0.0028453318,0.0010325758,0.0022572211,0.0069140326],"category_scores_gemma":[0.022422848,0.0003218134,0.0007510265,0.0018971484,0.0010273688,0.005495786,0.0010124549,0.0026042773,0.0018741122],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005560222,0.00024958156,0.03220083,0.0014682859,0.0002716026,0.0011056899,0.008119459,0.022863759,0.0009104873,0.49067092,0.128395,0.31318834],"study_design_scores_gemma":[0.00005534953,0.000035910445,0.006061556,0.00029495198,0.00006639715,0.00042461988,0.0036209412,0.13825458,0.00027473088,0.8180445,0.032820355,0.00004616554],"about_ca_topic_score_codex":0.0045117135,"about_ca_topic_score_gemma":0.004489237,"teacher_disagreement_score":0.0069140326,"about_ca_system_score_codex":0.0010597198,"about_ca_system_score_gemma":0.0007650659,"threshold_uncertainty_score":0.023129702},"labels":[],"label_agreement":null},{"id":"W4312568851","doi":"10.1609/icwsm.v11i1.14934","title":"A Longitudinal Study of Topic Classification on Twitter","year":2017,"lang":"en","type":"article","venue":"Proceedings of the International AAAI Conference on Web and Social Media","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Classifier (UML); Kaleidoscope; Artificial intelligence; Ranging; Entertainment; Machine learning; Feature (linguistics); Natural language processing; Data science; Information retrieval","score_opus":0.21531794813668617,"score_gpt":0.410507392061086,"score_spread":0.19518944392439982,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4312568851","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9912986,0.0004136528,0.0018762824,0.0015052323,0.0001001504,0.00004874093,0.00239114,0.00006120564,0.0023050501],"genre_scores_gemma":[0.99280775,0.00017479589,0.0009064616,0.00023994493,0.00013244474,0.000075318916,0.0033855108,0.00004445847,0.0022333495],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9986314,0.0006080644,0.000075941425,0.00028359072,0.00023386211,0.00016709194],"domain_scores_gemma":[0.9855503,0.005864947,0.0026732557,0.0016650314,0.0029424143,0.0013039109],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003660102,0.00026410108,0.00045049825,0.001421047,0.0013924092,0.0017836025,0.00049896375,0.00086444104,0.0029236027],"category_scores_gemma":[0.02159072,0.00027801984,0.000321523,0.0014235515,0.00051703706,0.0030258722,0.0012311572,0.0015978805,0.0017925039],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034270796,0.0006239983,0.94139075,0.000061565166,0.00011322745,0.00024260575,0.007946673,0.00064679945,0.0016505069,0.0014902664,0.01225027,0.033240534],"study_design_scores_gemma":[0.000025793208,0.00047120717,0.947255,0.00008375885,0.00008131591,0.00037498362,0.009150423,0.017247222,0.0015087259,0.001985166,0.02173846,0.00007808018],"about_ca_topic_score_codex":0.00855931,"about_ca_topic_score_gemma":0.010834765,"teacher_disagreement_score":0.00855931,"about_ca_system_score_codex":0.0006402511,"about_ca_system_score_gemma":0.00040406318,"threshold_uncertainty_score":0.019356668},"labels":[],"label_agreement":null},{"id":"W4313192137","doi":"10.33965/ijwi_202220103","title":"CHINESE IT COMPANIES UNDER U.S.-CHINA TRADE WAR: A COMPUTATIONAL POLITICAL COMMUNICATION PERSPECTIVE","year":2022,"lang":"en","type":"article","venue":"IADIS INTERNATIONAL JOURNAL ON WWW/INTERNET","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"China; Perspective (graphical); Politics; Trade war; Political science; International trade; Business; Computer science; Law; Artificial intelligence","score_opus":0.035548374527975796,"score_gpt":0.40994238229348473,"score_spread":0.3743940077655089,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313192137","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8380854,0.0018764023,0.05139026,0.02050168,0.000118878284,0.00011575738,0.0014136608,0.00013566879,0.08636226],"genre_scores_gemma":[0.99189186,0.0006050668,0.005141701,0.00016771752,0.000074396026,0.000044234075,0.00030267882,0.0000072695757,0.0017651784],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9996202,0.00019795987,0.000008654814,0.000056665252,0.00006125841,0.00005519699],"domain_scores_gemma":[0.99856275,0.001035368,0.0001405021,0.00007711894,0.0001125716,0.00007175331],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009543666,0.00030719463,0.00020812028,0.0018644328,0.0011855995,0.002368801,0.0005059856,0.00049890287,0.0025733097],"category_scores_gemma":[0.003248212,0.000119213946,0.0002597574,0.002139287,0.0011880678,0.0023017304,0.00081566867,0.00064851635,0.00018081919],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012228519,0.00019630603,0.09150196,0.00038960748,0.0001444909,0.0010348668,0.011109951,0.09225598,0.001871754,0.64348644,0.016269619,0.14161667],"study_design_scores_gemma":[0.000016251048,0.000038890143,0.03282954,0.00012339593,0.000055508634,0.00013034104,0.0104106795,0.76918757,0.00093870156,0.1698982,0.016337948,0.000032961347],"about_ca_topic_score_codex":0.03625242,"about_ca_topic_score_gemma":0.03113131,"teacher_disagreement_score":0.03625242,"about_ca_system_score_codex":0.0022149612,"about_ca_system_score_gemma":0.0020384737,"threshold_uncertainty_score":0.07208282},"labels":[],"label_agreement":null},{"id":"W4313257688","doi":"10.5430/wjel.v12n8p471","title":"A Computational-Augmented Critical Discourse Analysis of Tweets on the Saudi General Entertainment Authority Activities","year":2022,"lang":"en","type":"article","venue":"World Journal of English Language","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Prince Sattam bin Abdulaziz University","keywords":"Ideology; Computer science; Cluster analysis; Sentiment analysis; Presentation (obstetrics); Entertainment; Artificial intelligence; Data science; Sociology; Political science; Politics; Law","score_opus":0.0218464210174998,"score_gpt":0.3691581672534935,"score_spread":0.3473117462359937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313257688","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9393006,0.0004407359,0.042452633,0.0012082494,0.0001059534,0.00069783744,0.00544502,0.0002056267,0.010143434],"genre_scores_gemma":[0.92773247,0.00026720026,0.06333082,0.00014409769,0.00006300477,0.0006123559,0.0045473627,0.00004896154,0.0032536432],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.999116,0.00043251444,0.000055572586,0.00017738037,0.00015691908,0.00006160548],"domain_scores_gemma":[0.9947464,0.0039024428,0.00039497466,0.00023099135,0.00062881014,0.00009624489],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016291405,0.00045313107,0.00023021987,0.0035534631,0.0011830415,0.0017915188,0.0005977901,0.00050163164,0.002722756],"category_scores_gemma":[0.007013399,0.00013896608,0.0003916193,0.002663056,0.0010873533,0.0022982496,0.0013065714,0.0006381569,0.0005603496],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014841437,0.0011538088,0.1455569,0.0036918484,0.0001728048,0.0047692033,0.23825206,0.01610767,0.045429178,0.06192565,0.01939235,0.4620644],"study_design_scores_gemma":[0.00012902684,0.00050492166,0.18978791,0.0011782055,0.00023069604,0.0011992705,0.30156294,0.27146053,0.046657138,0.050354,0.13666289,0.0002725527],"about_ca_topic_score_codex":0.006640195,"about_ca_topic_score_gemma":0.010354324,"teacher_disagreement_score":0.006640195,"about_ca_system_score_codex":0.0014400978,"about_ca_system_score_gemma":0.0014510765,"threshold_uncertainty_score":0.0132030845},"labels":[],"label_agreement":null},{"id":"W4313318980","doi":"10.22148/001c.57197","title":"Grounding Theory in Digital Data: A Methodological Approach for a Reflective Procedural Framework","year":2022,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Process (computing); Set (abstract data type); Frame (networking); Data science; Grounded theory; Scale (ratio); Epistemology; Artificial intelligence; Qualitative research; Sociology","score_opus":0.3585206163766748,"score_gpt":0.502581587722082,"score_spread":0.14406097134540713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313318980","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035305398,0.00035015235,0.974912,0.00960429,0.00015699946,0.0011046777,0.000116511204,0.00010814213,0.0101167],"genre_scores_gemma":[0.119699635,0.00032168993,0.8721908,0.0011989924,0.000110712615,0.004627207,0.00016587834,0.00013785754,0.0015473377],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7711616,0.2013043,0.006696914,0.009947782,0.008999719,0.0018897306],"domain_scores_gemma":[0.7051488,0.22483349,0.0076330965,0.047567323,0.0119161755,0.002901236],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.23229374,0.0016275343,0.0022836514,0.012094539,0.009076297,0.023757657,0.009524037,0.0060776174,0.0059278985],"category_scores_gemma":[0.2013816,0.0018983207,0.002952008,0.010443179,0.07905978,0.026108075,0.016679635,0.0113525,0.001267886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000015146031,0.00004470389,0.00031176087,0.00022295084,0.000028033148,0.00007394215,0.025993552,0.00085373456,0.00017190246,0.96243894,0.0006301582,0.009215204],"study_design_scores_gemma":[0.000039907372,0.000031642092,0.00012347639,0.0006090838,0.000024736857,0.00005612871,0.010882599,0.00407668,0.000524581,0.95809823,0.025505468,0.000027511398],"about_ca_topic_score_codex":0.0046669478,"about_ca_topic_score_gemma":0.004703575,"teacher_disagreement_score":0.23229374,"about_ca_system_score_codex":0.014491725,"about_ca_system_score_gemma":0.023340376,"threshold_uncertainty_score":0.9467185},"labels":[],"label_agreement":null},{"id":"W4316174755","doi":"10.1177/14604582221115667","title":"Using ICD-9 diagnostic codes for external validation of topic models derived from primary care electronic medical record clinical text data","year":2023,"lang":"en","type":"article","venue":"Health Informatics Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"North York General Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Computer science; Diagnosis code; Topic model; Artificial intelligence; Face validity; Leverage (statistics); Natural language processing; Medicine; Population","score_opus":0.2999121611428252,"score_gpt":0.5167997459878955,"score_spread":0.21688758484507026,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4316174755","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.82474667,0.0005018312,0.15636502,0.00081207923,0.00020468775,0.0019765547,0.0123152435,0.0006275726,0.0024502927],"genre_scores_gemma":[0.9210076,0.00010679675,0.057013582,0.00013985146,0.00007504379,0.0018174391,0.019407896,0.00011636875,0.00031536503],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9632338,0.024399519,0.0032624411,0.005962186,0.0024112095,0.0007307775],"domain_scores_gemma":[0.7271673,0.21172604,0.019572295,0.020229032,0.01966872,0.0016365764],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.069954745,0.0009603446,0.0007264609,0.0052918782,0.0011535557,0.002829225,0.0016973709,0.0011515882,0.0015010294],"category_scores_gemma":[0.2660034,0.0004916759,0.0018275471,0.0038633104,0.0015086922,0.0021017601,0.0025137784,0.0021117206,0.0009488188],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008330825,0.00033798083,0.90538347,0.0005538988,0.00081097265,0.00016789959,0.0054293373,0.01732376,0.0016947816,0.0031619961,0.00497634,0.059326563],"study_design_scores_gemma":[0.00037681925,0.0007956058,0.55534387,0.0008031052,0.00061456027,0.0006236753,0.0051506534,0.40043572,0.006068073,0.01636628,0.013210968,0.0002106762],"about_ca_topic_score_codex":0.008840969,"about_ca_topic_score_gemma":0.007869991,"teacher_disagreement_score":0.069954745,"about_ca_system_score_codex":0.0021803998,"about_ca_system_score_gemma":0.0029193275,"threshold_uncertainty_score":0.3699605},"labels":[],"label_agreement":null},{"id":"W4317906531","doi":"10.1787/1f5307e7-en","title":"Identifying artificial intelligence actors using online data","year":2023,"lang":"en","type":"report","venue":"OECD science, technology and industry working papers","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Digital transformation; Core (optical fiber); Business; Business intelligence; Marketing; Digital economy; Data science; Knowledge management; Public relations; Political science; Artificial intelligence; Computer science; Telecommunications; World Wide Web","score_opus":0.5724628369035674,"score_gpt":0.5281625637658378,"score_spread":0.04430027313772955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4317906531","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.94067675,0.0006626902,0.0055172993,0.0010812664,0.000019164918,0.0002805357,0.019439531,0.00010154042,0.032221235],"genre_scores_gemma":[0.9613385,0.0008123791,0.011161244,0.00010340876,0.00004465708,0.0003779076,0.0221894,0.000030328163,0.003942162],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9973948,0.0008311063,0.00020633725,0.0003707775,0.00086382654,0.00033322096],"domain_scores_gemma":[0.98391473,0.010818304,0.0026242437,0.0006564975,0.0013598814,0.00062635186],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002209463,0.00032032913,0.00036471468,0.016786102,0.00087200524,0.0035737762,0.000497304,0.0008547934,0.004756473],"category_scores_gemma":[0.011470759,0.00019650746,0.00027588816,0.02143079,0.0006821914,0.0038975913,0.0017121165,0.00060541497,0.0017051217],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024880513,0.00027988403,0.86548394,0.0004709864,0.00008195916,0.00067723566,0.017751256,0.002514336,0.0025191866,0.018505694,0.007959983,0.08350671],"study_design_scores_gemma":[0.000048923444,0.0001234802,0.7512926,0.0005382187,0.000114810406,0.0004206936,0.08950161,0.04169998,0.004989977,0.013076221,0.098093815,0.00009969604],"about_ca_topic_score_codex":0.026017016,"about_ca_topic_score_gemma":0.036342714,"teacher_disagreement_score":0.026017016,"about_ca_system_score_codex":0.002104967,"about_ca_system_score_gemma":0.0015621195,"threshold_uncertainty_score":0.05173117},"labels":[],"label_agreement":null},{"id":"W4317910427","doi":"10.1177/20539517221149106","title":"Formally comparing topic models and human-generated qualitative coding of physician mothers’ experiences of workplace discrimination","year":2023,"lang":"en","type":"article","venue":"Big Data & Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"National Cancer Institute; National Center for Advancing Translational Sciences; National Institute of Arthritis and Musculoskeletal and Skin Diseases; National Human Genome Research Institute","keywords":"Coding (social sciences); Computer science; Thematic analysis; Leverage (statistics); Data science; Qualitative research; Topic model; Context (archaeology); Artificial intelligence; Sociology","score_opus":0.4102039748049899,"score_gpt":0.46940441320805104,"score_spread":0.05920043840306116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4317910427","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11550231,0.00025401634,0.8711876,0.0029804101,0.00013051758,0.0018982863,0.0015397639,0.0003900952,0.006117],"genre_scores_gemma":[0.59834635,0.00012957848,0.39270386,0.0005076421,0.000059724192,0.0058349036,0.0015740325,0.00015620358,0.0006877193],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8477873,0.13698336,0.0035194752,0.004960452,0.0060084444,0.00074094185],"domain_scores_gemma":[0.2967157,0.66075385,0.014142447,0.019643813,0.007960765,0.0007833885],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.111691155,0.0007794771,0.00061692635,0.0029120564,0.0015406902,0.0067727207,0.0031834322,0.0017503877,0.0040913443],"category_scores_gemma":[0.4052806,0.0007219624,0.00147213,0.0029038563,0.0060006166,0.006448964,0.0042910594,0.0025296875,0.00057159754],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012040971,0.0006768336,0.066076085,0.00411088,0.0007068086,0.00042622274,0.17973767,0.13924825,0.0038021493,0.44042242,0.007969051,0.15561956],"study_design_scores_gemma":[0.00040822595,0.0003648929,0.01671957,0.0017000124,0.00015765509,0.00027838908,0.037541013,0.5168979,0.004669337,0.39810032,0.022886531,0.0002760807],"about_ca_topic_score_codex":0.0055033653,"about_ca_topic_score_gemma":0.0061895605,"teacher_disagreement_score":0.8883088,"about_ca_system_score_codex":0.0067861746,"about_ca_system_score_gemma":0.00589964,"threshold_uncertainty_score":0.5906863},"labels":[],"label_agreement":null},{"id":"W4319659350","doi":"10.1007/s10506-023-09346-x","title":"Correction: Using attention methods to predict judicial outcomes","year":2023,"lang":"en","type":"article","venue":"Artificial Intelligence and Law","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Polytechnique Montréal","funders":"","keywords":"Philosophy of law; Computer science; Legal aspects of computing; Artificial intelligence; Cognitive psychology; Psychology; Political science; Law; The Internet; Comparative law; World Wide Web","score_opus":0.1992209616846759,"score_gpt":0.4873160492234294,"score_spread":0.2880950875387535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319659350","genre_codex":"editorial","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005753418,0.0006047359,0.002073019,0.07278328,0.9099664,0.00008122171,0.007967589,0.0013226471,0.0046258285],"genre_scores_gemma":[0.09965623,0.005333192,0.020921204,0.12127885,0.44298473,0.0013546871,0.013699406,0.0044670925,0.29030463],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99003905,0.0017001979,0.002284575,0.0017184931,0.0033794534,0.000878247],"domain_scores_gemma":[0.84309644,0.04705379,0.006381075,0.0168,0.082863964,0.0038047326],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0075987936,0.003160006,0.0036532988,0.007143696,0.0057785558,0.0061372104,0.0072654216,0.012854117,0.12604132],"category_scores_gemma":[0.24025117,0.0023587977,0.0019793494,0.007834833,0.0042633107,0.0046415003,0.0033795938,0.014432502,0.06343964],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004894709,0.000007228253,0.0002244605,0.00022955127,0.000052630035,0.00023769423,0.0000863804,0.00009589255,0.000048191458,0.00154249,0.991655,0.0057715126],"study_design_scores_gemma":[0.00035072706,0.000053808057,0.006166154,0.0012218998,0.0002856053,0.0012281779,0.00044696635,0.0031493455,0.0012592078,0.015201132,0.97039527,0.00024179369],"about_ca_topic_score_codex":0.02299007,"about_ca_topic_score_gemma":0.030928481,"teacher_disagreement_score":0.12604132,"about_ca_system_score_codex":0.004660922,"about_ca_system_score_gemma":0.008362194,"threshold_uncertainty_score":0.42165023},"labels":[],"label_agreement":null},{"id":"W4320022990","doi":"10.15173/sciential.v1i9.3183","title":"Exploring the Effectiveness and Accessibility of Lay Summaries in Four Open-Access Journals","year":2022,"lang":"en","type":"article","venue":"Sciential - McMaster Undergraduate Science Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Jargon; Rubric; CLARITY; Group cohesiveness; Psychology; Automatic summarization; Medical education; Computer science; Medicine; Pedagogy; Social psychology","score_opus":0.256141891123767,"score_gpt":0.4624379750270891,"score_spread":0.2062960839033221,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4320022990","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9537139,0.00508272,0.009655653,0.004614388,0.0009766186,0.0022123,0.0018796687,0.00068703346,0.021177612],"genre_scores_gemma":[0.97263545,0.0025988417,0.017799614,0.0007457464,0.0008952077,0.0016875856,0.0010664846,0.00023345594,0.0023376371],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.8493783,0.08201829,0.030093446,0.004688896,0.031823505,0.0019975565],"domain_scores_gemma":[0.16328414,0.6352815,0.11493056,0.02038824,0.058881283,0.0072342656],"candidate_categories":["metaresearch","open_science"],"consensus_categories":[],"category_scores_codex":[0.10147475,0.0006315774,0.0015476075,0.020097371,0.0027260985,0.013804645,0.0013577829,0.0012788683,0.0070614885],"category_scores_gemma":[0.6876661,0.00073141936,0.0012011543,0.011691418,0.0030708031,0.012722971,0.007722263,0.0015685802,0.0014251927],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035275018,0.0009649071,0.18060888,0.015737904,0.0010626817,0.0006813071,0.21409698,0.0011886967,0.0072834245,0.005046972,0.012255453,0.55754536],"study_design_scores_gemma":[0.00079383916,0.0068956963,0.7021828,0.012892449,0.001669732,0.0012150536,0.15189017,0.004286358,0.01001362,0.014663077,0.09260796,0.0008892647],"about_ca_topic_score_codex":0.0010144294,"about_ca_topic_score_gemma":0.0020972556,"teacher_disagreement_score":0.9986422,"about_ca_system_score_codex":0.0027232494,"about_ca_system_score_gemma":0.0042720865,"threshold_uncertainty_score":0.53665614},"labels":[],"label_agreement":null},{"id":"W4321765808","doi":"10.1089/ast.2022.0122","title":"The Emergence of Astrobiology: A Topic-Modeling Perspective","year":2023,"lang":"en","type":"article","venue":"Astrobiology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Astrobiology; Perspective (graphical); Biological evolution; Biology; Computer science; Artificial intelligence","score_opus":0.05800146850902382,"score_gpt":0.43175389077736726,"score_spread":0.37375242226834343,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4321765808","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12317878,0.016963879,0.7842873,0.0326502,0.0006205396,0.0004521959,0.0069717304,0.0012149622,0.03366043],"genre_scores_gemma":[0.6682632,0.011963013,0.3058033,0.0009652216,0.0016741961,0.0008391562,0.006050875,0.00041112443,0.0040298863],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99675363,0.0019084647,0.00016537435,0.00065038895,0.00037990185,0.00014227041],"domain_scores_gemma":[0.9553267,0.039599452,0.0020294425,0.0010144223,0.0013055431,0.0007244932],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.00620178,0.0009903956,0.0008223499,0.011783883,0.0015875788,0.00871512,0.0019365215,0.0018671099,0.0037495634],"category_scores_gemma":[0.026648339,0.0006901152,0.0016359907,0.0130216675,0.0030768306,0.011267439,0.0024042877,0.0025850146,0.00086151285],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018834017,0.00024634335,0.03827961,0.0013831808,0.00037283785,0.0005638592,0.01569732,0.08917355,0.001528057,0.7127846,0.014033129,0.12574913],"study_design_scores_gemma":[0.000049931758,0.000056019933,0.011429083,0.00046896082,0.00013623267,0.00034297458,0.005079879,0.40587813,0.00083717034,0.51966995,0.055987664,0.00006406659],"about_ca_topic_score_codex":0.011473842,"about_ca_topic_score_gemma":0.009274925,"teacher_disagreement_score":0.9882161,"about_ca_system_score_codex":0.0037254656,"about_ca_system_score_gemma":0.002910383,"threshold_uncertainty_score":0.03279853},"labels":[],"label_agreement":null},{"id":"W4323351127","doi":"10.1093/jcag/gwac036.115","title":"A115 THE PERFORMANCE OF NATURAL LANGUAGE PROCESSING IN INTERPRETING COLONOSCOPY REPORTS: A SYSTEMATIC REVIEW AND META-ANALYSIS","year":2023,"lang":"en","type":"review","venue":"Journal of the Canadian Association of Gastroenterology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Colonoscopy; Artificial intelligence; Computer science; Natural language processing; Meta-analysis; CINAHL; Receiver operating characteristic; Univariate; Systematic review; Bivariate analysis; Machine learning; MEDLINE; Medicine; Information retrieval; Medical physics; Data mining; Multivariate statistics; Pathology; Colorectal cancer; Internal medicine; Cancer","score_opus":0.039973834582464285,"score_gpt":0.3770505314235504,"score_spread":0.3370766968410861,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4323351127","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0063663106,0.98972535,0.0014138495,0.00033839126,0.00022452314,0.00074267836,0.0008300709,0.000052487667,0.00030627596],"genre_scores_gemma":[0.3324041,0.6475635,0.009489974,0.0016848827,0.00062007137,0.005746326,0.0019320921,0.00009771595,0.0004613286],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.94777,0.025891047,0.016035274,0.0039639547,0.005597765,0.0007420927],"domain_scores_gemma":[0.8296712,0.13649371,0.020698743,0.0038408684,0.008623628,0.00067190605],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.053081535,0.0033830532,0.016543252,0.01498974,0.0008755007,0.0048072585,0.0033202118,0.0029765293,0.00412814],"category_scores_gemma":[0.15770537,0.0020550848,0.05093425,0.01286072,0.0015203991,0.0039767986,0.0023014315,0.0020624667,0.00048732196],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012313888,0.000023487306,0.006995911,0.3982713,0.58234084,0.00010239178,0.000096694304,0.00041128325,0.00016332431,0.00012225893,0.00052663486,0.009714547],"study_design_scores_gemma":[0.00048228682,0.00019356323,0.0048994482,0.044415116,0.94800293,0.00009903265,0.000056758,0.0003006707,0.00013559725,0.00022805146,0.0011546636,0.000031952204],"about_ca_topic_score_codex":0.0058572227,"about_ca_topic_score_gemma":0.012847137,"teacher_disagreement_score":0.053081535,"about_ca_system_score_codex":0.003761039,"about_ca_system_score_gemma":0.005388691,"threshold_uncertainty_score":0.2807253},"labels":[],"label_agreement":null},{"id":"W4327956271","doi":"10.1007/s11135-023-01639-2","title":"A Bayesian index of association: comparison with other measures and performance","year":2023,"lang":"en","type":"article","venue":"Quality & Quantity","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Index (typography); Bayesian probability; Statistics; Association (psychology); Econometrics; Mathematics; Computer science; Psychology","score_opus":0.12072140584112305,"score_gpt":0.4349054045858594,"score_spread":0.31418399874473635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4327956271","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25745428,0.018652223,0.695742,0.003014271,0.0008566415,0.0006053337,0.0074778544,0.0026162104,0.013581125],"genre_scores_gemma":[0.71943235,0.0039743176,0.26609322,0.0004877367,0.00088879163,0.0005008921,0.0050308355,0.00059316267,0.0029987453],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9647127,0.020740388,0.0027953312,0.003316756,0.00798694,0.00044783766],"domain_scores_gemma":[0.60843384,0.34480324,0.010673,0.017847808,0.01537241,0.0028696335],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0686044,0.0013061657,0.0030702206,0.019231178,0.001569901,0.0053275744,0.00243315,0.003673069,0.0048112613],"category_scores_gemma":[0.24150637,0.00052265456,0.0023639053,0.012257343,0.0020775236,0.007890689,0.0038181758,0.0018098508,0.0014343734],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006550547,0.0012932548,0.25556776,0.0017085354,0.0069738985,0.00013661016,0.0012206673,0.07459694,0.0028158082,0.051054247,0.015105967,0.58297575],"study_design_scores_gemma":[0.0007402148,0.0029949336,0.11986235,0.00047485213,0.0027045235,0.001307709,0.0009112593,0.68965024,0.0034312306,0.16725078,0.009932188,0.0007397296],"about_ca_topic_score_codex":0.004664722,"about_ca_topic_score_gemma":0.0043397504,"teacher_disagreement_score":0.9313956,"about_ca_system_score_codex":0.002166329,"about_ca_system_score_gemma":0.0024137017,"threshold_uncertainty_score":0.36281908},"labels":[],"label_agreement":null},{"id":"W4360771999","doi":"10.2139/ssrn.4391108","title":"Can AI Detect Predatory Journals? The Case of FT50 Journals","year":2023,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Thompson Rivers University","funders":"","keywords":"Library science; Political science; Psychology; Computer science","score_opus":0.036502405225944924,"score_gpt":0.39575507356683537,"score_spread":0.3592526683408904,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4360771999","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93049824,0.0011819885,0.005981258,0.018366897,0.00027108713,0.00012476831,0.0012122213,0.00017686991,0.04218667],"genre_scores_gemma":[0.9910343,0.00026601847,0.003796858,0.0008093689,0.00020120903,0.000031087948,0.00026878665,0.00002688037,0.0035655221],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9961965,0.0015350714,0.00022922142,0.0005764475,0.00094420346,0.00051858416],"domain_scores_gemma":[0.88096815,0.08697792,0.016670838,0.004253563,0.007362153,0.003767327],"candidate_categories":["metaresearch","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.008770984,0.00039750405,0.0006568738,0.005744745,0.0020759592,0.0037018184,0.0015147936,0.0025518907,0.009047301],"category_scores_gemma":[0.10375634,0.000242107,0.000406983,0.005041258,0.0022124588,0.0061368267,0.0015145665,0.0013753067,0.0012582019],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019918657,0.0005730056,0.7039401,0.0010354868,0.00043935748,0.01149988,0.011875335,0.010587439,0.007976674,0.054961015,0.033990998,0.1611289],"study_design_scores_gemma":[0.0003868791,0.0009846252,0.55556923,0.0005953169,0.0005742222,0.007661438,0.039029133,0.17021912,0.011724467,0.15268634,0.060231052,0.0003381744],"about_ca_topic_score_codex":0.028884118,"about_ca_topic_score_gemma":0.027234888,"teacher_disagreement_score":0.9974481,"about_ca_system_score_codex":0.00179131,"about_ca_system_score_gemma":0.0014771332,"threshold_uncertainty_score":0.057431996},"labels":[],"label_agreement":null},{"id":"W4362668861","doi":"10.1017/s1049096523000239","title":"Software Citations in Political Science","year":2023,"lang":"en","type":"article","venue":"PS Political Science & Politics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Scripting language; Software; Computer science; Politics; Software engineering; Data science; Public good; Software walkthrough; Package development process; Social software engineering; Software analytics; Software construction; Software peer review; Software development; World Wide Web; Political science; Programming language; Law","score_opus":0.08026618783910051,"score_gpt":0.46123970095959277,"score_spread":0.38097351312049227,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4362668861","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15393889,0.037727267,0.3985313,0.07029362,0.004283013,0.00056180876,0.011542116,0.010593571,0.31252843],"genre_scores_gemma":[0.85072,0.009091392,0.112861685,0.0022982946,0.0027949214,0.0007658333,0.0037731174,0.0024588276,0.015235891],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9533833,0.028951906,0.003139879,0.0032464187,0.010638436,0.00064006046],"domain_scores_gemma":[0.5091253,0.4302571,0.02503025,0.013348772,0.020044662,0.0021939415],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.027758399,0.0006456311,0.0011239515,0.040822726,0.003617221,0.014422345,0.0016466868,0.0023342927,0.02643973],"category_scores_gemma":[0.2945737,0.0007363647,0.00083745184,0.062049765,0.007429252,0.011066743,0.0055836546,0.0022980834,0.0040226253],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006849584,0.000060036422,0.01756019,0.0018275221,0.0002082055,0.00023391454,0.005019674,0.0034859036,0.00042944026,0.7686441,0.04179895,0.16066356],"study_design_scores_gemma":[0.000050966744,0.000034337223,0.008676604,0.0016361648,0.00013141618,0.00030692195,0.0015253081,0.016088372,0.0010937138,0.82848,0.14189538,0.0000806709],"about_ca_topic_score_codex":0.005344219,"about_ca_topic_score_gemma":0.0037293457,"teacher_disagreement_score":0.9722416,"about_ca_system_score_codex":0.007578482,"about_ca_system_score_gemma":0.0069132107,"threshold_uncertainty_score":0.14680225},"labels":[],"label_agreement":null},{"id":"W4376149305","doi":"10.1177/07311214231167170","title":"The Intersections between Sociology and STS: A Big Data Approach","year":2023,"lang":"en","type":"article","venue":"Sociological Perspectives","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Big data; Data science; Sociology; IBM; Analytics; Publishing; Identification (biology); Computer science; Social science; Epistemology; Data mining; Political science","score_opus":0.3511245855249497,"score_gpt":0.46115792905511444,"score_spread":0.11003334353016475,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4376149305","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2407953,0.03357213,0.3780969,0.15412678,0.0018288809,0.0009135666,0.0037131973,0.00042280174,0.18653049],"genre_scores_gemma":[0.8668794,0.01249795,0.10804132,0.004436589,0.0012956348,0.0012372547,0.0009943583,0.00017813586,0.0044394378],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.97404015,0.01992673,0.0009414619,0.0008669779,0.0036495703,0.00057510496],"domain_scores_gemma":[0.8769811,0.10859504,0.003993476,0.0047435933,0.0038950136,0.0017917679],"candidate_categories":["bibliometrics","sts"],"consensus_categories":[],"category_scores_codex":[0.02107155,0.00065357913,0.00073105213,0.02859028,0.0067474246,0.018691959,0.001807671,0.0022893646,0.0031445844],"category_scores_gemma":[0.040306132,0.000671577,0.0005801191,0.02811566,0.021577287,0.025049753,0.008322785,0.0039100815,0.00044164492],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000052408875,0.00006676835,0.011852639,0.00081614475,0.000055993314,0.0005579362,0.07139118,0.0016438051,0.00046658807,0.8572753,0.005209236,0.05061195],"study_design_scores_gemma":[0.000016758522,0.000046163903,0.009196791,0.0016971801,0.00003950838,0.0003587736,0.15823366,0.00818689,0.0006793512,0.6456451,0.17584847,0.000051420306],"about_ca_topic_score_codex":0.004165453,"about_ca_topic_score_gemma":0.0064754556,"teacher_disagreement_score":0.9932526,"about_ca_system_score_codex":0.009538916,"about_ca_system_score_gemma":0.008442996,"threshold_uncertainty_score":0.111438334},"labels":[],"label_agreement":null},{"id":"W4377294223","doi":"10.1080/02606755.2023.2213550","title":"Observing political and societal changes in Finnish parliamentary speech data, 1980–2010, with topic modelling","year":2023,"lang":"en","type":"article","venue":"Parliaments Estates and Representation","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Library of Parliament","funders":"Academy of Finland","keywords":"Politics; Political science; Sociology; Political economy; Law","score_opus":0.16432247527236138,"score_gpt":0.40514055652530795,"score_spread":0.24081808125294657,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4377294223","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9695069,0.00045584855,0.0026928638,0.00030855674,0.00005667965,0.000056619465,0.022573708,0.00005663437,0.0042922064],"genre_scores_gemma":[0.9585733,0.00027635074,0.0031088516,0.000025221301,0.0000628948,0.00015141371,0.03604358,0.000020082363,0.0017384355],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99878365,0.0003497462,0.00017100514,0.00031835947,0.00022777874,0.00014950108],"domain_scores_gemma":[0.9947231,0.0037363134,0.0005898602,0.00026939527,0.00049508753,0.00018630878],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021291818,0.0003609627,0.00031519312,0.004058871,0.00089112,0.001228817,0.00040696608,0.0008476073,0.0017771603],"category_scores_gemma":[0.009991553,0.000173387,0.0005402628,0.0053720176,0.00050658954,0.0010863412,0.0010857907,0.0005795038,0.0010213742],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008550522,0.00026816357,0.7827224,0.0013140843,0.00031983329,0.0018598918,0.035290144,0.01747668,0.00815307,0.003639889,0.017154483,0.13094638],"study_design_scores_gemma":[0.000015695801,0.00007904386,0.94605297,0.00015232616,0.00012826036,0.0003397396,0.011968185,0.017497353,0.002022534,0.0007919065,0.020884503,0.000067605026],"about_ca_topic_score_codex":0.039217226,"about_ca_topic_score_gemma":0.050894216,"teacher_disagreement_score":0.039217226,"about_ca_system_score_codex":0.0010960517,"about_ca_system_score_gemma":0.000897971,"threshold_uncertainty_score":0.077977955},"labels":[],"label_agreement":null},{"id":"W4378191272","doi":"10.2139/ssrn.4453148","title":"'Decoding' Policy Perspectives: Structural Topic Modelling of European Central Bankers' Speeches","year":2023,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal; Center for Interuniversity Research and Analysis on Organizations","funders":"","keywords":"Decoding methods; Political science; Computer science; Telecommunications","score_opus":0.06994793678130766,"score_gpt":0.36486290523554027,"score_spread":0.2949149684542326,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4378191272","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.49230805,0.0024460426,0.46309984,0.01922547,0.0003948409,0.000084801075,0.001722707,0.00049831707,0.020219937],"genre_scores_gemma":[0.9815617,0.0006507626,0.0136728175,0.00022717996,0.00019295872,0.000061576815,0.0006110746,0.00008439137,0.002937448],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99528885,0.0036536385,0.00012164959,0.00054832414,0.00022394166,0.0001636384],"domain_scores_gemma":[0.95720494,0.040213794,0.00084750075,0.00081250083,0.000710988,0.00021028052],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011585141,0.0008930826,0.0010629386,0.0012569975,0.00071103347,0.0061521875,0.0012383154,0.0027652213,0.005787713],"category_scores_gemma":[0.06235158,0.00060355663,0.00083383673,0.0021965986,0.0013389138,0.004988462,0.0015104071,0.0029454443,0.0006904993],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00090295606,0.00019566866,0.013985016,0.00039482833,0.00034232787,0.00030396148,0.010175209,0.36432406,0.0017741707,0.5127498,0.008657642,0.08619429],"study_design_scores_gemma":[0.00006779126,0.00004830636,0.0042280112,0.00010050919,0.000091182315,0.000044007018,0.0010277841,0.7488904,0.0008780871,0.24015416,0.0044287294,0.000041073858],"about_ca_topic_score_codex":0.010228375,"about_ca_topic_score_gemma":0.006155856,"teacher_disagreement_score":0.011585141,"about_ca_system_score_codex":0.0015859167,"about_ca_system_score_gemma":0.0017362094,"threshold_uncertainty_score":0.061268866},"labels":[],"label_agreement":null},{"id":"W4379467399","doi":"10.22148/001c.74602","title":"Text-mining metadata: What can titles tell us of the history of modern and contemporary art?","year":2023,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Metadata; Reading (process); Digitization; Contemporary art; Computer science; Scholarship; The arts; Topic model; World Wide Web; Visual arts; History; Information retrieval; Art; Linguistics; Art history","score_opus":0.12504934775014093,"score_gpt":0.3525318226868839,"score_spread":0.22748247493674295,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379467399","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6594302,0.02096996,0.120007195,0.022583919,0.00167627,0.00058956444,0.12743291,0.001289321,0.046020586],"genre_scores_gemma":[0.84928477,0.004588858,0.07193239,0.0012253766,0.0014907265,0.00067772024,0.06581472,0.0002923516,0.004693164],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9964743,0.0015338062,0.00045911,0.00066769985,0.0006802275,0.00018484841],"domain_scores_gemma":[0.9667454,0.021969685,0.004433995,0.0029662873,0.0030107533,0.000873831],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0055764387,0.0004660782,0.00066697143,0.014299101,0.0015155092,0.0052450304,0.0012381691,0.0010495966,0.00313062],"category_scores_gemma":[0.040229548,0.00031510115,0.0006611809,0.017467558,0.0019718562,0.015115153,0.0019437317,0.0012736577,0.002135833],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00076544704,0.00028232601,0.38671792,0.0037865029,0.00028248166,0.00091260986,0.025153466,0.0026448322,0.006820761,0.054267865,0.057093192,0.4612725],"study_design_scores_gemma":[0.00010072134,0.0002630211,0.3082882,0.0036384382,0.00033314223,0.0015078816,0.06905973,0.02517829,0.0128874695,0.15268211,0.42578128,0.00027971723],"about_ca_topic_score_codex":0.0049247346,"about_ca_topic_score_gemma":0.006670476,"teacher_disagreement_score":0.9857009,"about_ca_system_score_codex":0.0014907746,"about_ca_system_score_gemma":0.0014379245,"threshold_uncertainty_score":0.029491365},"labels":[],"label_agreement":null},{"id":"W4379799113","doi":"10.54254/2753-7048/5/2022923","title":"Analysis for Public Discourse Based on Tweets Relevant Terms: Opposition to the US Supreme Courts Decision to Overturn Roe v. Wade","year":2023,"lang":"en","type":"article","venue":"Lecture Notes in Education Psychology and Public Media","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Abortion; Opposition (politics); Supreme court; Qualitative analysis; Human rights; Political science; Public opinion; Social media; First amendment; Focus group; Qualitative research; Sociology; Social psychology; Psychology; Public relations; Media studies; Law; Social science; Politics","score_opus":0.052902284841223814,"score_gpt":0.4320137961006486,"score_spread":0.37911151125942477,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379799113","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91445696,0.0006515197,0.010980134,0.0031700945,0.0003211336,0.0006225025,0.04346675,0.00056844903,0.025762403],"genre_scores_gemma":[0.9593952,0.00038563454,0.013827065,0.00028002184,0.00022881017,0.0010125247,0.018680802,0.0001678535,0.006022122],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9978994,0.0008501109,0.00019214183,0.0002821704,0.0005340949,0.00024209035],"domain_scores_gemma":[0.9841368,0.01243158,0.0015854271,0.0005043476,0.0011022495,0.00023963022],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021981283,0.0004762087,0.00024144056,0.0061283694,0.0016069723,0.002871815,0.00032419284,0.00069937616,0.004722881],"category_scores_gemma":[0.01505135,0.00014838784,0.00040440573,0.0062576793,0.00090009795,0.0028423797,0.0014818684,0.00090237486,0.001839687],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022218514,0.0006189055,0.22717874,0.0041781287,0.00029427576,0.0028806112,0.2905789,0.0028154268,0.048640803,0.03678642,0.066955864,0.31685007],"study_design_scores_gemma":[0.000073478164,0.00030793573,0.3164006,0.0011755851,0.00025356,0.00094233325,0.37747294,0.03205613,0.029805887,0.020803563,0.22048377,0.00022425676],"about_ca_topic_score_codex":0.006252241,"about_ca_topic_score_gemma":0.007862086,"teacher_disagreement_score":0.006252241,"about_ca_system_score_codex":0.0015262826,"about_ca_system_score_gemma":0.0010965749,"threshold_uncertainty_score":0.015799642},"labels":[],"label_agreement":null},{"id":"W4380887182","doi":"10.31235/osf.io/y6src","title":"Situated Knowledges and Partial Perspectives: A Framework for Radical Objectivity in Computational Social Science and Computational Humanities","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Objectivity (philosophy); Scholarship; Embodied cognition; Situated; Epistemology; Premise; Ideology; Sociology; Philosophy; Computer science; Political science; Artificial intelligence; Politics","score_opus":0.11892538450185633,"score_gpt":0.4321410432399511,"score_spread":0.31321565873809476,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380887182","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017579647,0.006719317,0.7954133,0.037020773,0.0007183643,0.00024230928,0.00018349323,0.00024098992,0.14188175],"genre_scores_gemma":[0.7062739,0.003854203,0.27593595,0.0026186905,0.0009000976,0.000995649,0.00020977111,0.00022752814,0.008984244],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98125124,0.014839811,0.00050379883,0.001171277,0.0018150316,0.00041880985],"domain_scores_gemma":[0.9764825,0.017944576,0.0010659923,0.0029532537,0.00087783893,0.00067582313],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.01924738,0.0011333169,0.0011060565,0.005462338,0.0061630625,0.015209133,0.0029143253,0.0032135074,0.004043341],"category_scores_gemma":[0.01947413,0.00069779565,0.0015418886,0.0037038042,0.0700491,0.022871537,0.0132179195,0.0066114394,0.00055840326],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000026023956,0.0000032849148,0.000059785958,0.000028659859,0.0000047764106,0.000020284793,0.0041400124,0.0001466251,0.000027666281,0.993291,0.00019873025,0.002076552],"study_design_scores_gemma":[0.000004444381,0.000003840035,0.000034818553,0.000047976253,0.0000035491018,0.000021881477,0.0011426499,0.00047336187,0.00006790085,0.9884343,0.009760618,0.0000044998715],"about_ca_topic_score_codex":0.0018556278,"about_ca_topic_score_gemma":0.0021488133,"teacher_disagreement_score":0.99383694,"about_ca_system_score_codex":0.0053982525,"about_ca_system_score_gemma":0.0044827955,"threshold_uncertainty_score":0.101791084},"labels":[],"label_agreement":null},{"id":"W4382203029","doi":"10.1609/aaai.v37i8.26196","title":"A Fair Generative Model Using LeCam Divergence","year":2023,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"Ministry of Science and ICT, South Korea; Korea Advanced Institute of Science and Technology; National Research Foundation of Korea; Institute for Information and Communications Technology Promotion; Korea Customs Service; National Research Foundation","keywords":"Benchmark (surveying); Divergence (linguistics); Measure (data warehouse); Computer science; Set (abstract data type); Range (aeronautics); Generative grammar; Sample size determination; Generative model; Statistical power; Sample (material); Machine learning; Data mining; Artificial intelligence; Statistics; Mathematics","score_opus":0.29306004426602666,"score_gpt":0.4240172083587,"score_spread":0.13095716409267333,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382203029","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015837135,0.0002263171,0.9799033,0.0007776402,0.00006272576,0.00008265702,0.00014549278,0.00019666221,0.0027679887],"genre_scores_gemma":[0.7503682,0.00047665255,0.22788529,0.0013484218,0.00023528222,0.0007976622,0.00079127366,0.00049279066,0.017604565],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9971444,0.0014784903,0.00008233068,0.00060141255,0.00042809715,0.0002652294],"domain_scores_gemma":[0.9886861,0.008469721,0.0006201065,0.0008902553,0.00084890204,0.00048492762],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0098479865,0.0011421372,0.0018361527,0.0011903192,0.0012545252,0.0032616497,0.0038103722,0.002617518,0.005204398],"category_scores_gemma":[0.025451316,0.0008081637,0.0012924438,0.00095320743,0.0034034064,0.0036094033,0.003483979,0.0034374914,0.00085070025],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000076812146,0.000051632567,0.0014456047,0.00005463679,0.000044454184,0.000118492055,0.00023081816,0.7171284,0.00097604113,0.2620576,0.0025269217,0.015288654],"study_design_scores_gemma":[0.00000943363,0.000013336566,0.000081523904,0.000010965056,0.000005453511,0.00001916453,0.000011389313,0.9316923,0.00020627287,0.06742388,0.00051518105,0.000011186613],"about_ca_topic_score_codex":0.005130228,"about_ca_topic_score_gemma":0.004888413,"teacher_disagreement_score":0.0098479865,"about_ca_system_score_codex":0.0029832614,"about_ca_system_score_gemma":0.0021909622,"threshold_uncertainty_score":0.052081764},"labels":[],"label_agreement":null},{"id":"W4382361706","doi":"10.2196/43011","title":"News Coverage of Face Masks in Australia During the Early COVID-19 Pandemic: Topic Modeling Study","year":2023,"lang":"en","type":"article","venue":"JMIR Infodemiology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Latent Dirichlet allocation; Topic model; Pandemic; Context (archaeology); Coronavirus disease 2019 (COVID-19); Perplexity; News media; Advertising; Computer science; History; Medicine; Business; Information retrieval; Artificial intelligence","score_opus":0.26537759139672845,"score_gpt":0.5037675809500298,"score_spread":0.23838998955330137,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382361706","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9957943,0.00035566476,0.0008742717,0.00040516787,0.000014068033,0.000049148453,0.0012732527,0.000014749711,0.0012193037],"genre_scores_gemma":[0.9954267,0.0004957717,0.0010932377,0.000057150217,0.00004748405,0.000082865394,0.0016499339,0.0000108826225,0.0011359442],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99899155,0.00038709433,0.00010493489,0.00021425486,0.00019703158,0.00010526204],"domain_scores_gemma":[0.9916272,0.005423958,0.0013553851,0.0002365474,0.0010838045,0.00027307335],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025827645,0.0003000886,0.00038176693,0.0033741517,0.00058938714,0.0016193636,0.0003872608,0.00048538897,0.0011953424],"category_scores_gemma":[0.009025017,0.00026917615,0.0006344794,0.0034381056,0.00043717623,0.0015042423,0.00088120054,0.00072802126,0.00035576476],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026276303,0.00020198317,0.91286576,0.00060515694,0.00017113847,0.0008291172,0.043917432,0.0020100463,0.0025201624,0.00095960114,0.0034708332,0.032186005],"study_design_scores_gemma":[0.0000060245734,0.00011134037,0.95190895,0.00015322374,0.00011503013,0.00033511792,0.01712623,0.02480004,0.0006074211,0.0003302904,0.0044690054,0.00003734396],"about_ca_topic_score_codex":0.036761165,"about_ca_topic_score_gemma":0.038006995,"teacher_disagreement_score":0.036761165,"about_ca_system_score_codex":0.0013106712,"about_ca_system_score_gemma":0.00085748185,"threshold_uncertainty_score":0.07309437},"labels":[],"label_agreement":null},{"id":"W4383822224","doi":"10.1162/coli_a_00485","title":"Obituary: Yorick Wilks","year":2023,"lang":"en","type":"article","venue":"Computational Linguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Obituary; Computer science; Philosophy; Theology","score_opus":0.06742586085169608,"score_gpt":0.41015240737440634,"score_spread":0.3427265465227103,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4383822224","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007011048,0.03251196,0.0005918498,0.29408517,0.5011037,0.00007482895,0.0016245398,0.0009545474,0.16835228],"genre_scores_gemma":[0.004765656,0.008866462,0.00022202362,0.05747,0.05275971,0.00005826013,0.00080112874,0.00048842985,0.8745683],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99902916,0.00015986589,0.00007102779,0.0002332241,0.00037296236,0.00013378853],"domain_scores_gemma":[0.99769443,0.0004282099,0.00017498326,0.00016267173,0.0011177802,0.0004219223],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010666304,0.001038211,0.0009160322,0.0011437301,0.0032087073,0.0042972816,0.0009927778,0.0034664385,0.1877274],"category_scores_gemma":[0.0077583482,0.00046121443,0.00052299694,0.0006564201,0.0010239664,0.0032598982,0.0026395556,0.0063955407,0.15804423],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000010229127,0.0000023057223,0.000020933294,0.00001921231,9.684497e-7,0.000033898763,0.000018708539,0.0000050261037,0.000022087204,0.00040108073,0.9962471,0.0032184818],"study_design_scores_gemma":[0.0000019312388,0.0000037754924,0.00008493145,0.000059585334,9.5135135e-7,0.000050971583,0.000041339503,0.00000867052,0.000041647047,0.0001504465,0.99955267,0.0000030255023],"about_ca_topic_score_codex":0.0057875235,"about_ca_topic_score_gemma":0.008839944,"teacher_disagreement_score":0.1877274,"about_ca_system_score_codex":0.001790916,"about_ca_system_score_gemma":0.0016518208,"threshold_uncertainty_score":0.62801075},"labels":[],"label_agreement":null},{"id":"W4384131467","doi":"10.3390/jrfm16070329","title":"“Decoding” Policy Perspectives: Structural Topic Modeling of European Central Bankers’ Speeches","year":2023,"lang":"en","type":"article","venue":"Journal of risk and financial management","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Transparency (behavior); Central bank; Independence (probability theory); Rhetoric; Monetary policy; Financial crisis; Political science; Inflation (cosmology); Accounting; Financial system; Economics; Monetary economics; Macroeconomics; Law","score_opus":0.026852158640289357,"score_gpt":0.3219291491033198,"score_spread":0.2950769904630305,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4384131467","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8228804,0.0008349476,0.16358157,0.0022096909,0.000098481076,0.00028462277,0.0015955,0.00024361124,0.008271147],"genre_scores_gemma":[0.9762807,0.00026210022,0.020789484,0.00008178191,0.000058847127,0.0002686056,0.0014232799,0.000050370247,0.0007847272],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9922814,0.0058167214,0.00028327882,0.0009037602,0.0004322977,0.00028241324],"domain_scores_gemma":[0.9362062,0.05961409,0.0017457269,0.0010300737,0.0011248828,0.0002790648],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013280753,0.00085623964,0.0006566081,0.0035787006,0.0009799798,0.0050610453,0.0010185165,0.0013987168,0.0028452666],"category_scores_gemma":[0.05340678,0.0004222067,0.000986112,0.0032751458,0.0012765634,0.0048997942,0.0021019152,0.001802269,0.00054941216],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025317678,0.0006980279,0.15797776,0.0012923282,0.00072862464,0.0010355519,0.19393368,0.1783652,0.0070550092,0.17248313,0.007629426,0.27626956],"study_design_scores_gemma":[0.00013749163,0.00012616738,0.029165015,0.0002815917,0.00018401502,0.00013705074,0.02115945,0.85292476,0.0020033554,0.0823091,0.0114809945,0.00009093668],"about_ca_topic_score_codex":0.005702632,"about_ca_topic_score_gemma":0.003571822,"teacher_disagreement_score":0.013280753,"about_ca_system_score_codex":0.0015553738,"about_ca_system_score_gemma":0.0012184156,"threshold_uncertainty_score":0.07023615},"labels":[],"label_agreement":null},{"id":"W4385503182","doi":"10.1016/j.engappai.2023.106848","title":"Smart investigation of artificial intelligence in renewable energy system technologies by natural language processing: Insightful pattern for decision-makers","year":2023,"lang":"en","type":"article","venue":"Engineering Applications of Artificial Intelligence","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Computer science; Scopus; Artificial intelligence; Machine learning; Information retrieval; Data science","score_opus":0.027899795530850622,"score_gpt":0.3242779501590814,"score_spread":0.29637815462823075,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385503182","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4367732,0.0014430356,0.48296848,0.012505974,0.0002006958,0.00034045216,0.0011053691,0.00066563213,0.06399723],"genre_scores_gemma":[0.9084201,0.00051317626,0.08803897,0.00040997288,0.00007251415,0.000076318975,0.00022306555,0.00003669837,0.0022091167],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99926895,0.00031468063,0.000058825713,0.0000973345,0.00022345713,0.00003666511],"domain_scores_gemma":[0.9977837,0.0012669931,0.0003276455,0.00026337276,0.0002974542,0.000060771312],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012915191,0.00026993404,0.00026964286,0.0011871527,0.00045301727,0.00289494,0.0005165302,0.0006071942,0.00249359],"category_scores_gemma":[0.0046554105,0.00014882685,0.0003217192,0.0008649342,0.0013213293,0.0054037725,0.0007126317,0.0008155074,0.0003674531],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034387212,0.0005144243,0.043129284,0.0009734629,0.00016523208,0.0009452976,0.002740317,0.02264964,0.04196339,0.48493657,0.009737462,0.39190114],"study_design_scores_gemma":[0.0000315502,0.0001368395,0.017506719,0.0001714402,0.00006941497,0.0003410196,0.0038347077,0.26216814,0.021752546,0.674834,0.019089423,0.000064235835],"about_ca_topic_score_codex":0.0005953946,"about_ca_topic_score_gemma":0.00093438063,"teacher_disagreement_score":0.00289494,"about_ca_system_score_codex":0.0004871183,"about_ca_system_score_gemma":0.0007150406,"threshold_uncertainty_score":0.008341908},"labels":[],"label_agreement":null},{"id":"W4385571788","doi":"10.18653/v1/2023.acl-long.734","title":"The Elephant in the Room: Analyzing the Presence of Big Tech in Natural Language Processing Research","year":2023,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"National Research Council Canada; Institute for Work & Health","funders":"LG Display; Deutscher Akademischer Austauschdienst; Niedersächsische Ministerium für Wissenschaft und Kultur","keywords":"Computer science; Georgia tech; Volume (thermodynamics); Library science; Physics","score_opus":0.11976832839198524,"score_gpt":0.49377366724401023,"score_spread":0.37400533885202497,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385571788","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"incentives","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"incentives","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8561078,0.023446033,0.058540445,0.031675354,0.0012347482,0.00029994795,0.007821446,0.00082580687,0.020048417],"genre_scores_gemma":[0.946843,0.0028181814,0.040029883,0.0015729035,0.0006739712,0.00028700195,0.005038029,0.00019859902,0.0025383949],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9968412,0.0017046501,0.00019642082,0.0005515402,0.00053542975,0.00017072301],"domain_scores_gemma":[0.966924,0.024083465,0.0032063876,0.002412501,0.0017816128,0.0015920928],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.004776802,0.00045071004,0.00057766214,0.0044188714,0.0019018747,0.0045157545,0.0012821608,0.001485525,0.0023341663],"category_scores_gemma":[0.03541942,0.00040250536,0.0004655868,0.0065464377,0.001626453,0.010572863,0.004974999,0.0014647683,0.0008999204],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001335058,0.0003230677,0.52402455,0.0017218302,0.00065122393,0.0020056334,0.040787004,0.0014216119,0.0045382357,0.029120747,0.079459965,0.31461102],"study_design_scores_gemma":[0.00013893619,0.00040121205,0.4934318,0.0015371195,0.00095075136,0.0025378065,0.10921633,0.04996421,0.004986852,0.20995925,0.12658475,0.00029099023],"about_ca_topic_score_codex":0.0025971478,"about_ca_topic_score_gemma":0.009252749,"teacher_disagreement_score":0.99558115,"about_ca_system_score_codex":0.0005805209,"about_ca_system_score_gemma":0.0007971028,"threshold_uncertainty_score":0.025262475},"labels":[],"label_agreement":null},{"id":"W4386000296","doi":"10.31235/osf.io/ewamx","title":"Quality Control for Quality Computational Concepts: Wrangling with Theory and Data Wrangling as Theorizing","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute on Governance","funders":"","keywords":"Formality; Quality (philosophy); Craft; Process (computing); Computer science; Control (management); Data quality; Management science; Data science; Epistemology; Artificial intelligence; Political science; Engineering; Law; Operations management","score_opus":0.2420541306345986,"score_gpt":0.5429487259625833,"score_spread":0.3008945953279847,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386000296","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021491535,0.0017665168,0.9432096,0.024297677,0.00022221648,0.00020654387,0.00011969882,0.00035905023,0.008327094],"genre_scores_gemma":[0.5131421,0.0010576895,0.48096246,0.0017045297,0.0003611049,0.0007384556,0.00022596904,0.00048232984,0.0013254075],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8175778,0.12361235,0.0107924165,0.016302273,0.029440839,0.0022743903],"domain_scores_gemma":[0.3509796,0.4873749,0.027140364,0.106332146,0.0249637,0.0032093844],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17818223,0.001474054,0.0027939302,0.013994702,0.0068558613,0.028708288,0.006642409,0.005462416,0.0041939192],"category_scores_gemma":[0.48479334,0.0021028635,0.0031678863,0.010459299,0.11391422,0.06001906,0.021818489,0.012822493,0.0005148734],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004163974,0.000026985177,0.0014202747,0.000178416,0.000041681935,0.00005185313,0.0067096166,0.0025531016,0.00022495446,0.97130865,0.0006074692,0.016835358],"study_design_scores_gemma":[0.000016248907,0.000015000548,0.00019182434,0.000164557,0.000014509235,0.000032655935,0.00091600465,0.0059392466,0.0005094135,0.9884553,0.003721523,0.00002377041],"about_ca_topic_score_codex":0.0050294446,"about_ca_topic_score_gemma":0.002490258,"teacher_disagreement_score":0.82181776,"about_ca_system_score_codex":0.01115841,"about_ca_system_score_gemma":0.010237952,"threshold_uncertainty_score":0.94232893},"labels":[],"label_agreement":null},{"id":"W4386195873","doi":"10.1038/s41597-023-02464-w","title":"Digitization of the Australian Parliamentary Debates, 1998–2022","year":2023,"lang":"en","type":"article","venue":"Scientific Data","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Parliament; Digitization; Democracy; Politics; Resource (disambiguation); Metadata; Public administration; Political science; Library science; Data science; Sociology; Computer science; World Wide Web; Law","score_opus":0.1295125417729573,"score_gpt":0.39690934396953004,"score_spread":0.26739680219657275,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386195873","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13914227,0.006252722,0.0034191469,0.005057581,0.0010256732,0.0008466785,0.6130989,0.0009899165,0.23016709],"genre_scores_gemma":[0.25849435,0.007036698,0.017876592,0.0017692206,0.0005312529,0.002922929,0.48767784,0.0006723448,0.22301874],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9967397,0.00038166647,0.0003643459,0.00034291376,0.001901674,0.00026967537],"domain_scores_gemma":[0.98875797,0.0017669161,0.0018127331,0.0017610359,0.005128806,0.0007725452],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002913886,0.0004318311,0.00043800342,0.021345386,0.0023533371,0.0028293987,0.0011614586,0.0007275153,0.019560339],"category_scores_gemma":[0.015199766,0.00078667206,0.00036106457,0.037678182,0.0007918038,0.0016651136,0.0029780057,0.0013380252,0.005737589],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044884533,0.00012782324,0.022973897,0.0035554862,0.00008519444,0.0007448245,0.05058613,0.0012377822,0.0040078815,0.022360649,0.59808743,0.29578397],"study_design_scores_gemma":[0.000008484227,0.000012830595,0.17635727,0.00026795824,0.000017232998,0.00013041396,0.0020187623,0.00025814085,0.00072994235,0.0006183619,0.8195564,0.000024227978],"about_ca_topic_score_codex":0.36132184,"about_ca_topic_score_gemma":0.505362,"teacher_disagreement_score":0.36132184,"about_ca_system_score_codex":0.007411446,"about_ca_system_score_gemma":0.010751333,"threshold_uncertainty_score":0.71843743},"labels":[],"label_agreement":null},{"id":"W4386231097","doi":"10.2139/ssrn.4548411","title":"Queering Artificial Intelligence: The Impact of Generative Conversational AI on the 2SLGBTQIAP Community. A Scoping Review","year":2023,"lang":"en","type":"review","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Generative grammar; Psychology; Artificial intelligence; Sociology; Computer science; Political science","score_opus":0.23534259319083511,"score_gpt":0.5175107710671427,"score_spread":0.2821681778763076,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386231097","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000118045304,0.99296314,0.0009586336,0.0030939393,0.00034314638,0.000020034266,0.000029825187,0.000019228732,0.0024540704],"genre_scores_gemma":[0.003368772,0.9910433,0.0025153984,0.0015354605,0.000490743,0.00010271015,0.00009895453,0.000021636124,0.00082297245],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.997547,0.0011856729,0.00019269594,0.00024535353,0.0007082208,0.00012108201],"domain_scores_gemma":[0.97362375,0.022040254,0.0005414782,0.0007034279,0.0026713668,0.00041974927],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0108667975,0.00083206245,0.0013643944,0.0060015363,0.0009923138,0.004725881,0.0025056635,0.0032317778,0.007240307],"category_scores_gemma":[0.022558881,0.00051556365,0.0011482402,0.006540603,0.0027872983,0.0062970053,0.0033412343,0.0032646921,0.0022201575],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000057063742,0.00004745318,0.00018845973,0.025548594,0.00017020399,0.000046861616,0.0006839674,0.000380947,0.00024189388,0.047006853,0.025969189,0.8996587],"study_design_scores_gemma":[0.000029937222,0.000081527876,0.0009771975,0.042183075,0.00023658261,0.00023057539,0.00054561946,0.00048465104,0.0003866356,0.04061343,0.91418964,0.000041125422],"about_ca_topic_score_codex":0.005896676,"about_ca_topic_score_gemma":0.006886217,"teacher_disagreement_score":0.0108667975,"about_ca_system_score_codex":0.0028033305,"about_ca_system_score_gemma":0.009851283,"threshold_uncertainty_score":0.057469785},"labels":[],"label_agreement":null},{"id":"W4386461755","doi":"10.32920/24084828.v1","title":"A Topic Modeling Assessment of Emerging Research Trends in the Environmental Science and Engineering Discipline","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Latent Dirichlet allocation; Publication; Metadata; Environmental research; Topic model; Engineering ethics; Discipline; Political science; Data science; Management science; Computer science; Library science; Engineering; Sociology; Environmental planning; Social science; Environmental science; World Wide Web","score_opus":0.23548738102752764,"score_gpt":0.5310463283489233,"score_spread":0.29555894732139565,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386461755","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5513275,0.0078046564,0.40415388,0.006244508,0.0005431155,0.0009397435,0.0115467785,0.0016127906,0.015826903],"genre_scores_gemma":[0.90829474,0.0017147351,0.077277996,0.00017903069,0.00028622613,0.00065693876,0.008219201,0.0001797739,0.0031914378],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9925747,0.0036371362,0.000682628,0.0017505467,0.00091622816,0.00043883658],"domain_scores_gemma":[0.94018847,0.0490101,0.003444286,0.0024637138,0.004129777,0.00076360453],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.022633314,0.0010555701,0.0010328548,0.011631738,0.0014201717,0.0069209742,0.0011164688,0.0017207577,0.0032301592],"category_scores_gemma":[0.0479031,0.00046758444,0.0040857755,0.010528971,0.0008555264,0.004447818,0.0019063053,0.001869502,0.001177043],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013005056,0.00041628597,0.45066816,0.0016120085,0.002576985,0.00043822548,0.006763278,0.08893362,0.0060302434,0.043417927,0.01658451,0.38125825],"study_design_scores_gemma":[0.0000868229,0.00041416902,0.16327208,0.0004900003,0.0009824443,0.0005403117,0.0061662244,0.7550417,0.0026342648,0.047457714,0.022769311,0.00014502155],"about_ca_topic_score_codex":0.008895462,"about_ca_topic_score_gemma":0.006959187,"teacher_disagreement_score":0.9883683,"about_ca_system_score_codex":0.00175244,"about_ca_system_score_gemma":0.0024960903,"threshold_uncertainty_score":0.11969781},"labels":[],"label_agreement":null},{"id":"W4386461773","doi":"10.32920/24084828","title":"A Topic Modeling Assessment of Emerging Research Trends in the Environmental Science and Engineering Discipline","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Latent Dirichlet allocation; Publication; Metadata; Environmental research; Discipline; Topic model; Engineering ethics; Political science; Management science; Computer science; Data science; Engineering; Sociology; Environmental planning; Social science; Environmental science; World Wide Web","score_opus":0.23548738102752764,"score_gpt":0.5310463283489233,"score_spread":0.29555894732139565,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386461773","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5513275,0.0078046564,0.40415388,0.006244508,0.0005431155,0.0009397435,0.0115467785,0.0016127906,0.015826903],"genre_scores_gemma":[0.90829474,0.0017147351,0.077277996,0.00017903069,0.00028622613,0.00065693876,0.008219201,0.0001797739,0.0031914378],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9925747,0.0036371362,0.000682628,0.0017505467,0.00091622816,0.00043883658],"domain_scores_gemma":[0.94018847,0.0490101,0.003444286,0.0024637138,0.004129777,0.00076360453],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.022633314,0.0010555701,0.0010328548,0.011631738,0.0014201717,0.0069209742,0.0011164688,0.0017207577,0.0032301592],"category_scores_gemma":[0.0479031,0.00046758444,0.0040857755,0.010528971,0.0008555264,0.004447818,0.0019063053,0.001869502,0.001177043],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013005056,0.00041628597,0.45066816,0.0016120085,0.002576985,0.00043822548,0.006763278,0.08893362,0.0060302434,0.043417927,0.01658451,0.38125825],"study_design_scores_gemma":[0.0000868229,0.00041416902,0.16327208,0.0004900003,0.0009824443,0.0005403117,0.0061662244,0.7550417,0.0026342648,0.047457714,0.022769311,0.00014502155],"about_ca_topic_score_codex":0.008895462,"about_ca_topic_score_gemma":0.006959187,"teacher_disagreement_score":0.9883683,"about_ca_system_score_codex":0.00175244,"about_ca_system_score_gemma":0.0024960903,"threshold_uncertainty_score":0.11969781},"labels":[],"label_agreement":null},{"id":"W4386553581","doi":"10.19173/irrodl.v24i3.7220","title":"Shifting Conversations on Online Distance Education in South Korean Society During the COVID-19 Pandemic: A Topic Modeling Analysis of News Articles","year":2023,"lang":"en","type":"article","venue":"The International Review of Research in Open and Distributed Learning","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Ode; Latent Dirichlet allocation; Sociology; Pandemic; Distance education; Social distance; Coronavirus disease 2019 (COVID-19); Topic model; Media studies; Social science; Computer science; Mathematics; Pedagogy; Artificial intelligence","score_opus":0.26179309142888146,"score_gpt":0.5432302129928894,"score_spread":0.28143712156400796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386553581","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99050856,0.0010700612,0.003020386,0.0010482322,0.00005846926,0.000064153486,0.0010726887,0.000028804881,0.0031286823],"genre_scores_gemma":[0.9921143,0.0011560183,0.0032119479,0.00019457078,0.000094232775,0.000093124,0.001444598,0.000029402672,0.0016617709],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9984085,0.0007655796,0.00015677551,0.00024696116,0.00025068858,0.00017158441],"domain_scores_gemma":[0.9852733,0.0109295165,0.001954637,0.0003996968,0.0010711161,0.00037171267],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031490927,0.00039707834,0.00032285854,0.0041599856,0.0013138264,0.00334363,0.00034151197,0.00061097654,0.0011801178],"category_scores_gemma":[0.008066386,0.0002254647,0.00053693826,0.0049111047,0.0010749559,0.0040819026,0.0017171148,0.0007646275,0.00039243198],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00062391785,0.00033587427,0.41932535,0.002137256,0.00025865546,0.0025131353,0.40374792,0.0026516723,0.010403606,0.007861969,0.0068337456,0.14330694],"study_design_scores_gemma":[0.00002170327,0.00018478019,0.43810335,0.00076766446,0.00027483518,0.0010237781,0.47519732,0.017491398,0.003704733,0.0043375734,0.058738753,0.00015410977],"about_ca_topic_score_codex":0.005561361,"about_ca_topic_score_gemma":0.009056783,"teacher_disagreement_score":0.005561361,"about_ca_system_score_codex":0.0012027101,"about_ca_system_score_gemma":0.0011115036,"threshold_uncertainty_score":0.016654193},"labels":[],"label_agreement":null},{"id":"W4386763309","doi":"10.36227/techrxiv.24143706","title":"GPT-4 as a Twitter Data Annotator: Unraveling Its Performance on a Stance Classification Task","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lakehead University; York University","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada","keywords":"Task (project management); Social media; Computer science; Legalization; Sample (material); Agreement; Artificial intelligence; Natural language processing; Psychology; World Wide Web; Linguistics; Engineering","score_opus":0.4371558115108097,"score_gpt":0.4815211424253667,"score_spread":0.04436533091455702,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386763309","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.70458496,0.0058189454,0.19047593,0.011893347,0.0034868752,0.0019352058,0.019851126,0.031117583,0.030836064],"genre_scores_gemma":[0.73924774,0.0006424971,0.21740112,0.0021887387,0.0004849688,0.0010531481,0.026430396,0.00129373,0.011257661],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9895858,0.0062218355,0.0004048102,0.0021593762,0.0011372336,0.0004908693],"domain_scores_gemma":[0.9735516,0.018100886,0.0008645005,0.00298118,0.003416128,0.0010857286],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01823508,0.0025959783,0.0014689525,0.0031186754,0.002343886,0.00323746,0.0030507299,0.00493491,0.004347108],"category_scores_gemma":[0.036504883,0.00066050974,0.0014208069,0.0022619716,0.0014020443,0.0049095456,0.0045219106,0.00437022,0.0060108104],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00696185,0.0022949295,0.084453076,0.0022002999,0.0015357954,0.0009095182,0.003096978,0.07721284,0.028460624,0.0044143884,0.13019052,0.65826917],"study_design_scores_gemma":[0.00026707142,0.00072056695,0.013570989,0.00018212931,0.00021623667,0.00023918445,0.0015223215,0.9502007,0.011943535,0.005912834,0.015064359,0.00016011202],"about_ca_topic_score_codex":0.024761267,"about_ca_topic_score_gemma":0.039802138,"teacher_disagreement_score":0.024761267,"about_ca_system_score_codex":0.0025483367,"about_ca_system_score_gemma":0.0031396912,"threshold_uncertainty_score":0.096437454},"labels":[],"label_agreement":null},{"id":"W4386888181","doi":"10.32920/24156462","title":"A Triple Bottom Line Analysis of Sustainability Trends in the Luxury Fashion Industry: A Topic Modeling Approach","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Sustainability; Triple bottom line; Fashion industry; Corporate social responsibility; Business; Newspaper; Social sustainability; Fast fashion; Sustainability organizations; Corporate sustainability; Marketing; Public relations; Advertising; Political science; Clothing","score_opus":0.15634062574078075,"score_gpt":0.4379607951084781,"score_spread":0.2816201693676973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386888181","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.737038,0.0031628823,0.21793477,0.004261117,0.0002124355,0.00092723785,0.025960336,0.0008420308,0.009661073],"genre_scores_gemma":[0.8853289,0.00096237846,0.08825924,0.00022280989,0.000223108,0.0014848011,0.019144842,0.00017764952,0.0041962033],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99800915,0.0008778229,0.00016816998,0.0005615252,0.00024369243,0.00013967374],"domain_scores_gemma":[0.98341215,0.013148536,0.0013102246,0.00055867207,0.001220635,0.00034986855],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047019906,0.0005823261,0.00051166647,0.009749529,0.00097215164,0.003117639,0.00088522735,0.0009999522,0.0026410324],"category_scores_gemma":[0.012071179,0.00037421918,0.0018015569,0.008400627,0.0005696608,0.0029212835,0.0014360354,0.001429887,0.001294797],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057432684,0.0009804518,0.50769925,0.0019205507,0.0011323611,0.0010620266,0.04627553,0.02357193,0.011366702,0.029841058,0.02623994,0.34933585],"study_design_scores_gemma":[0.000093152456,0.00046502822,0.32545727,0.0008738934,0.0009868213,0.00076703535,0.053651024,0.47600323,0.0063823042,0.042489354,0.09261041,0.00022044749],"about_ca_topic_score_codex":0.010877381,"about_ca_topic_score_gemma":0.011247599,"teacher_disagreement_score":0.010877381,"about_ca_system_score_codex":0.001239119,"about_ca_system_score_gemma":0.0012396247,"threshold_uncertainty_score":0.02486676},"labels":[],"label_agreement":null},{"id":"W4386897048","doi":"10.32920/24156462.v1","title":"A Triple Bottom Line Analysis of Sustainability Trends in the Luxury Fashion Industry: A Topic Modeling Approach","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Triple bottom line; Sustainability; Fashion industry; Corporate social responsibility; Business; Corporate sustainability; Newspaper; Social sustainability; Fast fashion; Sustainability organizations; Marketing; Public relations; Advertising; Political science; Clothing","score_opus":0.15634062574078075,"score_gpt":0.4379607951084781,"score_spread":0.2816201693676973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386897048","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.737038,0.0031628823,0.21793477,0.004261117,0.0002124355,0.00092723785,0.025960336,0.0008420308,0.009661073],"genre_scores_gemma":[0.8853289,0.00096237846,0.08825924,0.00022280989,0.000223108,0.0014848011,0.019144842,0.00017764952,0.0041962033],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99800915,0.0008778229,0.00016816998,0.0005615252,0.00024369243,0.00013967374],"domain_scores_gemma":[0.98341215,0.013148536,0.0013102246,0.00055867207,0.001220635,0.00034986855],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047019906,0.0005823261,0.00051166647,0.009749529,0.00097215164,0.003117639,0.00088522735,0.0009999522,0.0026410324],"category_scores_gemma":[0.012071179,0.00037421918,0.0018015569,0.008400627,0.0005696608,0.0029212835,0.0014360354,0.001429887,0.001294797],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057432684,0.0009804518,0.50769925,0.0019205507,0.0011323611,0.0010620266,0.04627553,0.02357193,0.011366702,0.029841058,0.02623994,0.34933585],"study_design_scores_gemma":[0.000093152456,0.00046502822,0.32545727,0.0008738934,0.0009868213,0.00076703535,0.053651024,0.47600323,0.0063823042,0.042489354,0.09261041,0.00022044749],"about_ca_topic_score_codex":0.010877381,"about_ca_topic_score_gemma":0.011247599,"teacher_disagreement_score":0.010877381,"about_ca_system_score_codex":0.001239119,"about_ca_system_score_gemma":0.0012396247,"threshold_uncertainty_score":0.02486676},"labels":[],"label_agreement":null},{"id":"W4387030912","doi":"10.12677/ml.2023.119548","title":"A Corpus-Based Study on China Image: Taking Canadian Mainstream Media’s Coverage of the Beijing Winter Olympics as an Example","year":2023,"lang":"en","type":"article","venue":"Modern Linguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Beijing; Mainstream; China; Media coverage; Geography; Political science; Advertising; Media studies; Sociology; Business","score_opus":0.07007495466463612,"score_gpt":0.365100103307817,"score_spread":0.29502514864318086,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387030912","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93408215,0.0022651008,0.000564085,0.0026938543,0.00018751404,0.00015752391,0.014827366,0.00004287679,0.04517953],"genre_scores_gemma":[0.9742532,0.0017464488,0.0012039343,0.00064550585,0.000106553925,0.00014232923,0.012680707,0.00007232552,0.009148992],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9991578,0.00011679564,0.000037670776,0.00012012232,0.00035655615,0.0002110709],"domain_scores_gemma":[0.9949549,0.001367783,0.00050194416,0.00028704212,0.0023735412,0.000514798],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001047202,0.00038168833,0.00025564057,0.009328789,0.0056992453,0.0025250425,0.0008174439,0.0008183464,0.0053729685],"category_scores_gemma":[0.005513921,0.00017136635,0.00019958825,0.023198638,0.002268633,0.0016317592,0.0018360373,0.00091383705,0.00053784024],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000389833,0.00042141433,0.37362123,0.0015726325,0.00019349677,0.004810512,0.3340377,0.0004836601,0.010656238,0.019053003,0.13442442,0.12033593],"study_design_scores_gemma":[0.000013800874,0.000035764937,0.692211,0.0004046587,0.000096982665,0.00041919257,0.1655861,0.00047754895,0.0012493326,0.0003955065,0.13904789,0.000062166655],"about_ca_topic_score_codex":0.91478723,"about_ca_topic_score_gemma":0.9671322,"teacher_disagreement_score":0.08521277,"about_ca_system_score_codex":0.012753219,"about_ca_system_score_gemma":0.01487671,"threshold_uncertainty_score":0.17142916},"labels":[],"label_agreement":null},{"id":"W4387641764","doi":"10.1093/llc/fqad072","title":"A quantitative window on the history of statistics: topic-modelling 120 years of<i>Biometrika</i>","year":2023,"lang":"en","type":"article","venue":"Digital Scholarship in the Humanities","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Canada Research Chairs; Canada Foundation for Innovation; Université du Québec à Montréal","keywords":"Publishing; History; Epistemology; Statistics; Sociology; Mathematics; Philosophy; Law; Political science","score_opus":0.2665025376473324,"score_gpt":0.3647625749984127,"score_spread":0.0982600373510803,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387641764","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6858037,0.041310705,0.15224858,0.025838422,0.0011134086,0.00021107844,0.010119207,0.0005158758,0.08283903],"genre_scores_gemma":[0.9708301,0.0055385055,0.017160468,0.0004673453,0.0007045551,0.00018316564,0.0018574542,0.00022137146,0.0030370017],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99502724,0.0028327713,0.00031365757,0.00075468485,0.0008644438,0.00020717981],"domain_scores_gemma":[0.92838556,0.060892437,0.004514643,0.0023637088,0.0027593842,0.001084225],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.012908291,0.00040220292,0.00062375976,0.012353704,0.0017013185,0.008828521,0.0006918154,0.0009730514,0.0064856973],"category_scores_gemma":[0.045620162,0.0003307822,0.0006262539,0.016122067,0.0035617356,0.010275418,0.002852792,0.0017218605,0.00096923887],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049044983,0.00014154613,0.14474592,0.0025556823,0.00044539318,0.0011838838,0.14722443,0.008850532,0.0029873939,0.48374078,0.02157261,0.18606132],"study_design_scores_gemma":[0.00004207924,0.0002529034,0.22925988,0.0049068867,0.00033785784,0.0012069963,0.061318688,0.04290284,0.0028171514,0.34491917,0.31179687,0.0002386558],"about_ca_topic_score_codex":0.0038709883,"about_ca_topic_score_gemma":0.0038832903,"teacher_disagreement_score":0.9876463,"about_ca_system_score_codex":0.0021811873,"about_ca_system_score_gemma":0.0016223453,"threshold_uncertainty_score":0.06826639},"labels":[],"label_agreement":null},{"id":"W4387706663","doi":"10.22148/001c.88113","title":"Operationalizing Canonicity: A Quantitative Study of French 19th and 20th Century Literature","year":2023,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Agence Nationale de la Recherche","keywords":"Operationalization; Grammar; Sociology; Norm (philosophy); Politics; Literary criticism; Cultural transmission in animals; Sociocultural evolution; Linguistics; Epistemology; Philosophy; Law; Political science; Anthropology","score_opus":0.08131779061149383,"score_gpt":0.42113231399091483,"score_spread":0.339814523379421,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387706663","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98041564,0.00086737855,0.0013145941,0.0004095304,0.000021965794,0.000084578125,0.0008345023,0.0000330212,0.016018778],"genre_scores_gemma":[0.9970663,0.00030831,0.0006760956,0.000055841498,0.000032081723,0.000087318505,0.0005554817,0.000017676924,0.0012008523],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9943658,0.0026794453,0.00044618253,0.00054792955,0.001592465,0.0003682272],"domain_scores_gemma":[0.9456034,0.035984997,0.0073156944,0.0017312383,0.0081144655,0.0012501815],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.009823462,0.00040530882,0.00043055112,0.02161371,0.0032448682,0.0053377724,0.0008252139,0.0009293208,0.0032329622],"category_scores_gemma":[0.047856424,0.00017903566,0.00030187776,0.014021902,0.004661347,0.0038069622,0.0026009888,0.00067144516,0.00051064254],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015656154,0.00015022213,0.37167898,0.0007280278,0.000106817635,0.00078730506,0.5454724,0.00062324246,0.0015797928,0.020266335,0.002260203,0.056190073],"study_design_scores_gemma":[0.000011859532,0.00015255056,0.63688624,0.00047816866,0.00004104911,0.0007121591,0.3074324,0.0024527502,0.0010513472,0.0038818917,0.046814185,0.00008540776],"about_ca_topic_score_codex":0.037124943,"about_ca_topic_score_gemma":0.03294151,"teacher_disagreement_score":0.9783863,"about_ca_system_score_codex":0.006411304,"about_ca_system_score_gemma":0.0018995717,"threshold_uncertainty_score":0.07381767},"labels":[],"label_agreement":null},{"id":"W4388780012","doi":"10.1515/9781552384039-014","title":"Textual Analysis","year":2006,"lang":"en","type":"book-chapter","venue":"University of Calgary Press eBooks","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Computer science","score_opus":0.03494889728120991,"score_gpt":0.2632649299378924,"score_spread":0.2283160326566825,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388780012","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012723734,0.0023309765,0.30256557,0.0037295304,0.0017028939,0.0021731898,0.06471994,0.034109816,0.57594436],"genre_scores_gemma":[0.060304094,0.0019175089,0.2308566,0.0008569445,0.0005743917,0.0014303842,0.0751453,0.008137235,0.62077755],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99760985,0.00048311808,0.0002025145,0.0005468906,0.0010270842,0.0001305811],"domain_scores_gemma":[0.9939215,0.0015957234,0.00023741463,0.0010512875,0.0030513278,0.00014272856],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020814291,0.001125637,0.0006246468,0.009533952,0.0019969693,0.0042307614,0.0011947835,0.00057097786,0.17051232],"category_scores_gemma":[0.0089335125,0.00054279796,0.0008343789,0.0063173063,0.0007697876,0.0028762466,0.0024093883,0.0012675758,0.1097773],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009052543,0.000050018734,0.00090598624,0.0004523186,0.00002376079,0.00007896611,0.0015619278,0.00021138838,0.0076100617,0.019456066,0.2610236,0.7085354],"study_design_scores_gemma":[0.000013793237,0.000023410563,0.0020371382,0.00022971416,0.000034798966,0.00017139387,0.0013717493,0.0021463581,0.010259672,0.007421755,0.976263,0.000027292357],"about_ca_topic_score_codex":0.0070834546,"about_ca_topic_score_gemma":0.008001007,"teacher_disagreement_score":0.17051232,"about_ca_system_score_codex":0.0015491438,"about_ca_system_score_gemma":0.0029107137,"threshold_uncertainty_score":0.5704205},"labels":[],"label_agreement":null},{"id":"W4388864379","doi":"10.17821/srels/2023/v60i5/170707","title":"Text Mining of Journal Article Titles: An LDA-Based Topic Modeling Approach","year":2023,"lang":"en","type":"article","venue":"Journal of Information and Knowledge","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Science North","funders":"","keywords":"Latent Dirichlet allocation; Topic model; Computer science; Data science; Field (mathematics); Scholarship; Information retrieval; Mathematics; Political science","score_opus":0.06950786620653424,"score_gpt":0.3762300616837654,"score_spread":0.3067221954772311,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388864379","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.096152216,0.0078102346,0.8648672,0.0024247298,0.00055661664,0.0021146692,0.014634356,0.004849968,0.006590049],"genre_scores_gemma":[0.45672017,0.004082814,0.5062643,0.00031237543,0.0013697536,0.0028288432,0.019620601,0.00045703107,0.008344125],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99579453,0.0014590964,0.0005737148,0.0010421757,0.00089162844,0.00023890872],"domain_scores_gemma":[0.9935407,0.003884208,0.00073521514,0.0003938257,0.0012772926,0.0001687808],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0048558805,0.0013715827,0.001724634,0.02311014,0.0015303654,0.0033172355,0.0015266589,0.0012425001,0.0019185133],"category_scores_gemma":[0.010382845,0.000571298,0.0030271355,0.015796708,0.0006249035,0.002578951,0.0014289023,0.0013578507,0.0027537122],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005882485,0.001081999,0.0408579,0.0018995452,0.0013813364,0.0005865928,0.003131898,0.024961181,0.0130708795,0.007994124,0.03732221,0.8671241],"study_design_scores_gemma":[0.00017933598,0.0005602339,0.0625146,0.0004677319,0.0012850999,0.0014039635,0.0028007715,0.81453925,0.011058863,0.033058826,0.07175812,0.00037326492],"about_ca_topic_score_codex":0.0056622974,"about_ca_topic_score_gemma":0.008019092,"teacher_disagreement_score":0.02311014,"about_ca_system_score_codex":0.0010617028,"about_ca_system_score_gemma":0.0021146445,"threshold_uncertainty_score":0.025680661},"labels":[],"label_agreement":null},{"id":"W4388932493","doi":"10.55111/j.issn2709-1961.202306048","title":"Research hotspots of mutuality: A visualization analysis based on CiteSpace","year":2023,"lang":"en","type":"article","venue":"Chinese Journal of Integrative Nursing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Visualization; Geography; Computer science; Data mining","score_opus":0.1039381681021056,"score_gpt":0.5505232883221446,"score_spread":0.446585120220039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388932493","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7509551,0.030580403,0.04524677,0.007160068,0.0008180572,0.0013939709,0.05517951,0.010061037,0.09860514],"genre_scores_gemma":[0.91800755,0.0056035193,0.05807724,0.00014090475,0.0002980082,0.0008107999,0.012131216,0.00044210206,0.004488685],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99675614,0.000850505,0.0005366918,0.00041145075,0.0011927082,0.00025242672],"domain_scores_gemma":[0.9744285,0.016024431,0.004396648,0.0010450555,0.003274528,0.00083079154],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.005339843,0.000965697,0.0009037051,0.11479,0.0021965194,0.0074601634,0.00081645173,0.00092795555,0.008390033],"category_scores_gemma":[0.020718945,0.0003176741,0.0012744775,0.101284064,0.0009755926,0.007191101,0.0044543743,0.00055219885,0.00086825603],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007925072,0.00018141163,0.24935979,0.016821904,0.0011250218,0.0031094917,0.095011495,0.0036744336,0.012633388,0.068548284,0.0511916,0.49755076],"study_design_scores_gemma":[0.00016400694,0.0002984657,0.4027901,0.0047554863,0.0016440636,0.0033507422,0.10005212,0.026301168,0.00763864,0.06382744,0.3887137,0.00046404882],"about_ca_topic_score_codex":0.005897573,"about_ca_topic_score_gemma":0.0068238773,"teacher_disagreement_score":0.88521,"about_ca_system_score_codex":0.001987288,"about_ca_system_score_gemma":0.002754997,"threshold_uncertainty_score":0.028240144},"labels":[],"label_agreement":null},{"id":"W4389131146","doi":"10.4337/9781803920306.00008","title":"A systematic review of scholarship in AI and communication research (1990-2022)","year":2023,"lang":"en","type":"review","venue":"Edward Elgar Publishing eBooks","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Scholarship; Web of science; Quarter (Canadian coin); Key (lock); Library science; Period (music); Psychology; Data science; Computer science; Political science; History; MEDLINE; Art","score_opus":0.2611967916980024,"score_gpt":0.5153003329103691,"score_spread":0.2541035412123667,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389131146","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012283166,0.99593383,0.0002506187,0.00059721916,0.00029558758,0.00043875317,0.0006677987,0.000008260789,0.00057954487],"genre_scores_gemma":[0.010274822,0.9861004,0.0011322164,0.0006329481,0.00015082966,0.0010073244,0.00046798858,0.0000068303957,0.00022662347],"study_design_codex":"systematic_review","study_design_gemma":"not_applicable","domain_scores_codex":[0.9804049,0.006875977,0.0070930263,0.001151068,0.0039829956,0.0004920046],"domain_scores_gemma":[0.9407589,0.03652976,0.009512406,0.0012041803,0.011153928,0.00084079005],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0189397,0.0014954652,0.004370728,0.03475287,0.0012735837,0.0032182185,0.0015567213,0.0018911401,0.0045976765],"category_scores_gemma":[0.075412184,0.0012533683,0.0041576573,0.03229283,0.0012944476,0.0040266886,0.0025882192,0.0013469401,0.00076859427],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014359111,0.000018230805,0.0010839292,0.88494146,0.002350269,0.00020874797,0.00092456123,0.00007858515,0.00033575273,0.00082589616,0.005985432,0.10310361],"study_design_scores_gemma":[0.00007558233,0.00010845197,0.004540111,0.9324704,0.0085970955,0.0003777394,0.0008446752,0.000035372665,0.00017249878,0.00040466356,0.0523476,0.000025863306],"about_ca_topic_score_codex":0.010175702,"about_ca_topic_score_gemma":0.039909862,"teacher_disagreement_score":0.96524715,"about_ca_system_score_codex":0.006148981,"about_ca_system_score_gemma":0.031667896,"threshold_uncertainty_score":0.10016394},"labels":[],"label_agreement":null},{"id":"W4389207051","doi":"10.22215/etd/2023-15787","title":"Topic Modeling for Intellectual Property Research: Comparing Methods Through Simulation and Application","year":2023,"lang":"en","type":"dissertation","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Carleton University","funders":"","keywords":"Trademark; Coherence (philosophical gambling strategy); Intellectual property; Computer science; Metric (unit); Data science; Topic model; Property (philosophy); Cluster analysis; Information retrieval; Data mining; Artificial intelligence; Engineering; Mathematics","score_opus":0.594168270023047,"score_gpt":0.6258136252021957,"score_spread":0.03164535517914879,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389207051","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.41879892,0.0071028983,0.5565653,0.0044497363,0.00040109627,0.0010074292,0.0009442912,0.0009992478,0.009731166],"genre_scores_gemma":[0.7586234,0.0030137743,0.23397659,0.00037051074,0.00022296263,0.0012118286,0.0011163005,0.00024222107,0.0012223877],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9897177,0.008153459,0.00037746594,0.0007424156,0.0008132278,0.00019569868],"domain_scores_gemma":[0.7521592,0.2345431,0.0029937285,0.0057498915,0.0039019152,0.0006522017],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.027908573,0.0010043001,0.0013914721,0.0032831358,0.001149696,0.0029199866,0.0019418049,0.0019748295,0.0018129618],"category_scores_gemma":[0.094568625,0.00050624635,0.0015225846,0.0033804527,0.001234759,0.004325544,0.0017450011,0.0026579166,0.00044456977],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078489725,0.0005130008,0.024226265,0.00075949007,0.00066441554,0.00007117313,0.0015617891,0.82357365,0.00071163266,0.045763552,0.0035333633,0.097836904],"study_design_scores_gemma":[0.000061850784,0.00012856361,0.0013147084,0.00006988096,0.000047161684,0.000020813186,0.0002592038,0.97790945,0.0002938845,0.018690206,0.0011818256,0.000022390619],"about_ca_topic_score_codex":0.016204748,"about_ca_topic_score_gemma":0.01302068,"teacher_disagreement_score":0.97209144,"about_ca_system_score_codex":0.0035571845,"about_ca_system_score_gemma":0.0022560046,"threshold_uncertainty_score":0.14759642},"labels":[],"label_agreement":null},{"id":"W4389222933","doi":"10.1590/2318-0889202335e236917","title":"Ethnographic studies in Information Science: bibliometric analysis in the Web of Science database","year":2023,"lang":"en","type":"article","venue":"Transinformação","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico","keywords":"Ethnography; Information science; Web of science; Field (mathematics); Sociology; Resource (disambiguation); Library science; Computer science; MEDLINE; Political science; Anthropology; Mathematics","score_opus":0.16143876319376632,"score_gpt":0.4726963591968311,"score_spread":0.3112575960030648,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389222933","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.84669197,0.016623475,0.063207,0.0020550513,0.0002662795,0.0034431287,0.019141678,0.00064304244,0.047928497],"genre_scores_gemma":[0.9448618,0.00332752,0.044420917,0.000090294336,0.000141402,0.0020820666,0.004382903,0.000056924735,0.000636214],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9263714,0.04473144,0.009829426,0.0022385444,0.015872847,0.0009563514],"domain_scores_gemma":[0.80900186,0.15836978,0.014114718,0.006742048,0.01074643,0.001025078],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.027355693,0.00038597142,0.0012696015,0.10356447,0.0015747022,0.0065946337,0.0008542663,0.00061283575,0.0026303714],"category_scores_gemma":[0.1402523,0.00025068244,0.0010059251,0.18728325,0.0013781597,0.00411395,0.0034012885,0.0004797022,0.00037017107],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026504017,0.00033138745,0.59068465,0.007592414,0.0014291595,0.0005602707,0.015197993,0.0034098872,0.0012410396,0.026710423,0.011205472,0.34137228],"study_design_scores_gemma":[0.00016993802,0.0003562545,0.7966789,0.0043913526,0.0012646548,0.0020211553,0.047742832,0.038062405,0.0038435892,0.032291688,0.07297019,0.00020698928],"about_ca_topic_score_codex":0.0047985017,"about_ca_topic_score_gemma":0.0041322745,"teacher_disagreement_score":0.9726443,"about_ca_system_score_codex":0.0023800805,"about_ca_system_score_gemma":0.0033094597,"threshold_uncertainty_score":0.1446724},"labels":[{"model":"gemma","categories":["bibliometrics"],"domain":null,"study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["bibliometrics"],"domain":null,"study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W4389256182","doi":"10.16995/dscn.10231","title":"Ecological Modelling: Applying Computational Linguistic Analysis to the UN Secretary-General’s Speeches on Climate Change (2018–2022)","year":2023,"lang":"en","type":"article","venue":"Digital Studies / Le champ numérique","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Latent Dirichlet allocation; Climate change; Humanities; Topic model; Sociology; Philosophy; Computer science; Ecology; Artificial intelligence; Biology","score_opus":0.14422618926304864,"score_gpt":0.3693065111214384,"score_spread":0.22508032185838978,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389256182","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4420996,0.0029647152,0.49307823,0.015077748,0.00052661,0.00052440836,0.007521485,0.0021738808,0.03603334],"genre_scores_gemma":[0.7926475,0.00069550873,0.19905291,0.00044277828,0.00014627229,0.0004762463,0.0043347958,0.0001603817,0.00204362],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99681926,0.002540167,0.000106437496,0.00027373197,0.00017015848,0.000090245536],"domain_scores_gemma":[0.9718037,0.026318813,0.000574676,0.00064760156,0.00051014323,0.00014487054],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043150177,0.0005603915,0.00036477155,0.0030909816,0.0014198553,0.0041862116,0.0013621411,0.0010356846,0.0038478714],"category_scores_gemma":[0.026072744,0.0003358622,0.0013929742,0.0023885597,0.0011865236,0.0023395568,0.0021085688,0.0017884134,0.00061436417],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00059000513,0.00075210514,0.047481958,0.0012142884,0.00060671964,0.0011957026,0.02444456,0.38396183,0.00230344,0.1961584,0.02188149,0.31940958],"study_design_scores_gemma":[0.000025181218,0.000028769182,0.0049980027,0.0001488353,0.000041686577,0.00006457997,0.0037554614,0.9112745,0.0003914081,0.06786863,0.01136019,0.000042825053],"about_ca_topic_score_codex":0.038630288,"about_ca_topic_score_gemma":0.04415862,"teacher_disagreement_score":0.038630288,"about_ca_system_score_codex":0.0027258706,"about_ca_system_score_gemma":0.0021486804,"threshold_uncertainty_score":0.07681084},"labels":[],"label_agreement":null},{"id":"W4389346539","doi":"10.5430/bmr.v13n1p50","title":"Analyzing the Personality of Party and Government Leaders: A LDA Topic Model","year":2023,"lang":"en","type":"article","venue":"Business and Management Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Natural Science Foundation of China","keywords":"Personality psychology; Government (linguistics); Personality; Public relations; Politics; Latent Dirichlet allocation; Context (archaeology); Sociology; Political science; Marketing; Topic model; Psychology; Social psychology; Business; Computer science; Law; Artificial intelligence","score_opus":0.2920202371383513,"score_gpt":0.47464338512812,"score_spread":0.1826231479897687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389346539","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.65313035,0.0013349873,0.33691493,0.0014729196,0.00016146994,0.00051347737,0.0018775784,0.0003186372,0.004275666],"genre_scores_gemma":[0.95483744,0.00058875734,0.03900807,0.00009051484,0.00013750928,0.00046142165,0.0019313247,0.000046232042,0.0028986523],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99763536,0.0013388331,0.00010159951,0.00045980627,0.00024187447,0.00022256695],"domain_scores_gemma":[0.99413717,0.004308318,0.0003650657,0.00041485234,0.0005662745,0.00020843183],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005123695,0.0008466355,0.0009295629,0.0034456619,0.0014769174,0.002865759,0.0010737736,0.00092251325,0.0019014765],"category_scores_gemma":[0.008547668,0.0004989136,0.0022980233,0.0031671878,0.001002014,0.0014828545,0.0013336691,0.0014421571,0.0008623551],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001354436,0.0012483113,0.41148204,0.00056821347,0.0013341573,0.0009438393,0.013312092,0.16814624,0.0056311213,0.05823987,0.014499929,0.32323977],"study_design_scores_gemma":[0.00003133767,0.000079724945,0.027598228,0.000047979775,0.00011498317,0.00014024413,0.0010573369,0.9546562,0.0002892847,0.013525745,0.0024122493,0.00004671259],"about_ca_topic_score_codex":0.016500296,"about_ca_topic_score_gemma":0.012653458,"teacher_disagreement_score":0.016500296,"about_ca_system_score_codex":0.0014551171,"about_ca_system_score_gemma":0.0013024086,"threshold_uncertainty_score":0.032808483},"labels":[],"label_agreement":null},{"id":"W4389377855","doi":"10.32920/24756813","title":"Humanities Research Software Design: The Wilde Trials Web App","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Newspaper; Software; Web application; World Wide Web; Media studies; Computer science; Sociology","score_opus":0.80380319332485,"score_gpt":0.5853401012347249,"score_spread":0.21846309209012504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389377855","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012045764,0.0010699078,0.71731067,0.014209804,0.0015212438,0.007494394,0.023403851,0.075963795,0.14698058],"genre_scores_gemma":[0.06929969,0.0010253128,0.8017419,0.0038285821,0.0007072988,0.020095816,0.011606445,0.013314592,0.07838031],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9924036,0.004977528,0.000550256,0.000900079,0.0010312393,0.00013728092],"domain_scores_gemma":[0.9431568,0.043929625,0.0012770172,0.006384971,0.0038705221,0.0013810871],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013750252,0.0006185071,0.0005518771,0.0025235526,0.0013401046,0.004185353,0.0015759981,0.0011269539,0.09168811],"category_scores_gemma":[0.044990204,0.0008375607,0.0008007792,0.0018135373,0.0018776557,0.004251647,0.0041817892,0.0016477839,0.031218374],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045951188,0.00034360786,0.0033068042,0.0016718336,0.00014726125,0.00061143626,0.0075578378,0.0017384469,0.0029793966,0.07373178,0.48986942,0.4175827],"study_design_scores_gemma":[0.00046880156,0.00018839995,0.003335996,0.0005953948,0.000048341615,0.00042370387,0.0019914948,0.008071525,0.0029771756,0.10600806,0.87579876,0.000092363836],"about_ca_topic_score_codex":0.0011839573,"about_ca_topic_score_gemma":0.0030375218,"teacher_disagreement_score":0.09168811,"about_ca_system_score_codex":0.0008776338,"about_ca_system_score_gemma":0.0025545075,"threshold_uncertainty_score":0.3067273},"labels":[],"label_agreement":null},{"id":"W4389377940","doi":"10.32920/24756813.v1","title":"Humanities Research Software Design: The Wilde Trials Web App","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Newspaper; Software; Web application; Media studies; Political science; World Wide Web; Sociology; Computer science","score_opus":0.80380319332485,"score_gpt":0.5853401012347249,"score_spread":0.21846309209012504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389377940","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012045764,0.0010699078,0.71731067,0.014209804,0.0015212438,0.007494394,0.023403851,0.075963795,0.14698058],"genre_scores_gemma":[0.06929969,0.0010253128,0.8017419,0.0038285821,0.0007072988,0.020095816,0.011606445,0.013314592,0.07838031],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9924036,0.004977528,0.000550256,0.000900079,0.0010312393,0.00013728092],"domain_scores_gemma":[0.9431568,0.043929625,0.0012770172,0.006384971,0.0038705221,0.0013810871],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013750252,0.0006185071,0.0005518771,0.0025235526,0.0013401046,0.004185353,0.0015759981,0.0011269539,0.09168811],"category_scores_gemma":[0.044990204,0.0008375607,0.0008007792,0.0018135373,0.0018776557,0.004251647,0.0041817892,0.0016477839,0.031218374],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045951188,0.00034360786,0.0033068042,0.0016718336,0.00014726125,0.00061143626,0.0075578378,0.0017384469,0.0029793966,0.07373178,0.48986942,0.4175827],"study_design_scores_gemma":[0.00046880156,0.00018839995,0.003335996,0.0005953948,0.000048341615,0.00042370387,0.0019914948,0.008071525,0.0029771756,0.10600806,0.87579876,0.000092363836],"about_ca_topic_score_codex":0.0011839573,"about_ca_topic_score_gemma":0.0030375218,"teacher_disagreement_score":0.09168811,"about_ca_system_score_codex":0.0008776338,"about_ca_system_score_gemma":0.0025545075,"threshold_uncertainty_score":0.3067273},"labels":[],"label_agreement":null},{"id":"W4389452749","doi":"10.1111/bjso.12707","title":"Canadian politicians' rhetoric on Twitter/X: Analysing prejudice and inclusion towards Muslims using structural topic modelling and rhetorical analysis","year":2023,"lang":"en","type":"article","venue":"British Journal of Social Psychology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Toronto Metropolitan University","funders":"Mitacs; UK Research and Innovation","keywords":"Rhetoric; Populism; Prejudice (legal term); Rhetorical question; Sociology; Multiculturalism; Politics; Ideology; Solidarity; Social media; Social psychology; Media studies; Gender studies; Political science; Psychology; Law; Linguistics","score_opus":0.09448230342171532,"score_gpt":0.4291919257504752,"score_spread":0.3347096223287599,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389452749","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9676193,0.00073496596,0.0024147446,0.0021281957,0.00007055952,0.0002604611,0.006397893,0.00009827182,0.020275451],"genre_scores_gemma":[0.98689574,0.000496429,0.0036947683,0.0002469255,0.000046158533,0.00024365127,0.0032128664,0.000047618134,0.005115908],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.99834657,0.00036884783,0.00006171844,0.00019676604,0.0007174985,0.00030848457],"domain_scores_gemma":[0.9907381,0.005570324,0.00088532775,0.00020969161,0.0022390387,0.00035759798],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026090145,0.00046022318,0.0004056113,0.0055964277,0.0046100407,0.0036360663,0.00068861555,0.00073906075,0.0021482685],"category_scores_gemma":[0.010373231,0.00023500492,0.00033169135,0.0063419556,0.0022975698,0.0012947737,0.0013219089,0.0009894548,0.00043714812],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00073521753,0.00017122367,0.26552898,0.0020977315,0.00012051008,0.0011307031,0.5456124,0.0026330824,0.011403531,0.021270018,0.025566518,0.12373014],"study_design_scores_gemma":[0.00004740229,0.00009682099,0.48593098,0.00067993987,0.0002018862,0.00023991254,0.32917336,0.018239945,0.0056854114,0.003702559,0.15574734,0.00025450662],"about_ca_topic_score_codex":0.8748607,"about_ca_topic_score_gemma":0.91438836,"teacher_disagreement_score":0.1251393,"about_ca_system_score_codex":0.02027841,"about_ca_system_score_gemma":0.020878172,"threshold_uncertainty_score":0.2517525},"labels":[],"label_agreement":null},{"id":"W4389518289","doi":"10.18653/v1/2023.bigpicture-1.3","title":"Computational Narrative Understanding: A Big Picture Analysis","year":2023,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Narrative; Storytelling; Narrative network; Narrative criticism; Narrative inquiry; Field (mathematics); Computer science; Narrative psychology; Narrative structure; Meaning (existential); Cognitive science; Epistemology; Sociology; Psychology; Linguistics","score_opus":0.16269848190602101,"score_gpt":0.4168807254781885,"score_spread":0.25418224357216745,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389518289","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038563658,0.005268686,0.8889108,0.015130457,0.00028496265,0.00065691094,0.0136195235,0.0028722654,0.034692787],"genre_scores_gemma":[0.26756936,0.0024237568,0.7116159,0.0006457156,0.00015459696,0.00079221034,0.01170973,0.000582748,0.004505963],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9976419,0.0010658798,0.0001832071,0.00047120024,0.0005418947,0.000096039024],"domain_scores_gemma":[0.9900596,0.006355147,0.0006763448,0.0018199207,0.0007400607,0.00034890595],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00348427,0.00078189565,0.0006476346,0.00576713,0.0021155293,0.007860933,0.0030657228,0.0016512563,0.011852601],"category_scores_gemma":[0.026694076,0.00071233703,0.0016663055,0.004639051,0.002933201,0.015024905,0.0072148927,0.0027161322,0.0015279272],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002158821,0.000107653665,0.008081247,0.0013006363,0.00018471082,0.00081912614,0.012643451,0.013080595,0.0017000106,0.71112615,0.043834288,0.20690623],"study_design_scores_gemma":[0.000021034448,0.000018901028,0.0021254192,0.00031130388,0.0000524931,0.00029818088,0.0069590816,0.0974496,0.001228252,0.7830018,0.108494185,0.000039783998],"about_ca_topic_score_codex":0.0047673583,"about_ca_topic_score_gemma":0.0063701407,"teacher_disagreement_score":0.011852601,"about_ca_system_score_codex":0.0019146056,"about_ca_system_score_gemma":0.0017627908,"threshold_uncertainty_score":0.039650857},"labels":[],"label_agreement":null},{"id":"W4389524588","doi":"10.18653/v1/2023.findings-emnlp.816","title":"Dimensions of Online Conflict: Towards Modeling Agonism","year":2023,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Agonism; Association (psychology); Computer science; Cognitive science; Sociology; Psychology; Philosophy; Epistemology; Political science; Law","score_opus":0.16138472538670157,"score_gpt":0.44137659357715137,"score_spread":0.2799918681904498,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389524588","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5883406,0.0028976635,0.26962426,0.016858103,0.0004475933,0.00067016715,0.0058825295,0.0005738791,0.11470522],"genre_scores_gemma":[0.96419096,0.00031830816,0.032749392,0.00019906095,0.00006371903,0.00033818337,0.0010861845,0.000056554098,0.0009976882],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969229,0.002132138,0.00013784705,0.00037074843,0.00028067318,0.00015562098],"domain_scores_gemma":[0.98334336,0.011301304,0.0022015804,0.0012158989,0.0010492185,0.0008886277],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036724585,0.00072508416,0.00041728216,0.0022829443,0.0013413465,0.0060355617,0.0010274452,0.001095018,0.007282973],"category_scores_gemma":[0.033433698,0.000490866,0.00092176726,0.0022009527,0.0021786876,0.008181713,0.0035150878,0.0024839786,0.00082302606],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007980239,0.0006565277,0.24149877,0.0005530888,0.0005091766,0.00028111908,0.022455728,0.039022923,0.00059235876,0.5597283,0.02516795,0.108736016],"study_design_scores_gemma":[0.000087868095,0.000109871355,0.04080751,0.0002702615,0.00012936765,0.00023079528,0.013705924,0.27238446,0.00032840625,0.6518013,0.020048553,0.000095763164],"about_ca_topic_score_codex":0.004268176,"about_ca_topic_score_gemma":0.00491503,"teacher_disagreement_score":0.007282973,"about_ca_system_score_codex":0.0017678466,"about_ca_system_score_gemma":0.0011141909,"threshold_uncertainty_score":0.024363995},"labels":[],"label_agreement":null},{"id":"W4390201590","doi":"10.1002/alz.071430","title":"Bias in Acoustic‐ and Linguistic‐based Classifications of Alzheimer’s Disease","year":2023,"lang":"en","type":"article","venue":"Alzheimer s & Dementia","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Computer Research Institute of Montréal","funders":"","keywords":"Psychology; Grammaticality; Fluency; Cognitive psychology; Computer science; Linguistics; Grammar","score_opus":0.1589044524354684,"score_gpt":0.4015107415600906,"score_spread":0.24260628912462218,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390201590","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97770715,0.0010449128,0.009633678,0.0007727899,0.00034820297,0.00018990271,0.0032359117,0.00009587561,0.006971402],"genre_scores_gemma":[0.9922133,0.0002332961,0.0034964508,0.00032468882,0.00017495731,0.00016353151,0.0026580426,0.000041179406,0.0006945769],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98778874,0.0057242904,0.0017087088,0.0019588203,0.0023660983,0.00045327342],"domain_scores_gemma":[0.96586764,0.01819782,0.0036250302,0.0035191504,0.007984191,0.0008061152],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.015219363,0.0004196391,0.000551237,0.0022008817,0.0007126895,0.002368438,0.0006726835,0.0008772137,0.0020538238],"category_scores_gemma":[0.053911634,0.00016998664,0.00042703506,0.0009001375,0.00091644254,0.0012255261,0.0017630938,0.00064421,0.0012034327],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014547597,0.00015601453,0.8715027,0.00039136672,0.00040609745,0.00020075827,0.004021822,0.0011012648,0.009686645,0.0009931874,0.0055740876,0.10451129],"study_design_scores_gemma":[0.0000658738,0.00036662107,0.96018016,0.00039711987,0.0002650118,0.00080486515,0.006520705,0.009497446,0.008365682,0.004580817,0.008847631,0.00010811254],"about_ca_topic_score_codex":0.0021355168,"about_ca_topic_score_gemma":0.0038115652,"teacher_disagreement_score":0.9847806,"about_ca_system_score_codex":0.00054787734,"about_ca_system_score_gemma":0.0004095505,"threshold_uncertainty_score":0.08048862},"labels":[],"label_agreement":null},{"id":"W4390773980","doi":"10.1017/s0008423923000604","title":"Le Bloc québécois et la souveraineté : une analyse des communiqués de presse de 2002 à 2021","year":2024,"lang":"fr","type":"article","venue":"Canadian Journal of Political Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval; Université du Québec à Montréal","funders":"","keywords":"Humanities; Political science; Physics; Philosophy","score_opus":0.03047740804769514,"score_gpt":0.37422612012525147,"score_spread":0.3437487120775563,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390773980","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9501387,0.0022273557,0.00093571894,0.0011437432,0.00005962987,0.0000687088,0.009838432,0.00004593106,0.03554186],"genre_scores_gemma":[0.98214704,0.00074772607,0.00048123798,0.000104534825,0.00002369691,0.000051544284,0.0036761991,0.00002765484,0.012740367],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9994702,0.00006823259,0.000023054527,0.00009117017,0.00021772983,0.00012980564],"domain_scores_gemma":[0.996763,0.0007504687,0.00046333863,0.00007531505,0.001563818,0.0003840379],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00073128485,0.0003056431,0.00028286508,0.004302034,0.0019768886,0.003341398,0.0004545152,0.00031131756,0.008154825],"category_scores_gemma":[0.0021447877,0.00018527184,0.00024106611,0.011201367,0.0012339249,0.0010591157,0.000843197,0.0007544829,0.00053746207],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030858826,0.00006816032,0.7267063,0.0006504155,0.00024381255,0.0009971748,0.116141096,0.0022069535,0.002065425,0.012784023,0.0280221,0.109806046],"study_design_scores_gemma":[0.0000035911985,0.000018283636,0.9151634,0.000102941485,0.000023626624,0.0000426118,0.040742714,0.0006277878,0.00017888965,0.0001287823,0.04294696,0.000020410198],"about_ca_topic_score_codex":0.93994725,"about_ca_topic_score_gemma":0.96847486,"teacher_disagreement_score":0.060052752,"about_ca_system_score_codex":0.014775041,"about_ca_system_score_gemma":0.008696733,"threshold_uncertainty_score":0.12081277},"labels":[],"label_agreement":null},{"id":"W4390824166","doi":"10.1515/9782766301850-015","title":"Agenda-Setting of Domestic Violence on Social Media: Machine Learning and Content Analysis Approach","year":2023,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada); University of Toronto","funders":"","keywords":"Social media; Content (measure theory); Content analysis; Domestic violence; Computer science; Sociology; Media studies; Public relations; Psychology; Criminology; Political science; Internet privacy; World Wide Web; Social science; Medicine; Medical emergency; Human factors and ergonomics; Mathematics; Poison control","score_opus":0.15130930783537738,"score_gpt":0.37542435716793826,"score_spread":0.22411504933256088,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390824166","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041536264,0.010780229,0.34844834,0.08307046,0.00144758,0.001139586,0.001619482,0.0003525811,0.5116055],"genre_scores_gemma":[0.7613782,0.0065985825,0.1836466,0.003566233,0.0010692207,0.0014022401,0.0014992695,0.0002478689,0.04059171],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9911137,0.0065652207,0.00032160195,0.00051552756,0.001152492,0.00033153236],"domain_scores_gemma":[0.9830831,0.014262268,0.0006890211,0.0005423498,0.0010647608,0.0003584344],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009951032,0.00058699975,0.0007584192,0.005869135,0.0027869456,0.011250537,0.0022972287,0.003436415,0.006027574],"category_scores_gemma":[0.01932889,0.0005547931,0.00092522975,0.0056173215,0.007564239,0.016061308,0.0036452282,0.004147514,0.0008504122],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022153285,0.0000508876,0.0010802705,0.00028729744,0.000029319994,0.00016863966,0.009028304,0.0015376539,0.00021627157,0.92675745,0.012194118,0.048627626],"study_design_scores_gemma":[0.0000136263025,0.000016325728,0.0015527245,0.000905358,0.000020678495,0.00011297986,0.014288873,0.011507665,0.0007307009,0.9166211,0.054197982,0.000032045777],"about_ca_topic_score_codex":0.003303157,"about_ca_topic_score_gemma":0.0047223526,"teacher_disagreement_score":0.011250537,"about_ca_system_score_codex":0.0060363193,"about_ca_system_score_gemma":0.0045600147,"threshold_uncertainty_score":0.05262667},"labels":[],"label_agreement":null},{"id":"W4391065254","doi":"10.5539/ijel.v14n1p1","title":"The Rhetorical Communication of Identification Theory in the Translation of Chinese News into English","year":2024,"lang":"en","type":"article","venue":"International Journal of English Linguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Mainland China; Publicity; Social media; Identification (biology); Advertising; Agency (philosophy); Source text; Rhetorical question; Narrative; China; Media studies; Sociology; Political science; Public relations; Psychology; Social science; Business; Law; Literature; Art","score_opus":0.031190210417478513,"score_gpt":0.4001066088579922,"score_spread":0.3689163984405137,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391065254","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5735068,0.0018432355,0.13989213,0.020288903,0.0006380049,0.00042839957,0.00017082503,0.00017101054,0.26306075],"genre_scores_gemma":[0.9899933,0.0002062402,0.007274167,0.00033652972,0.00006310302,0.00013551643,0.000032013908,0.000024368206,0.0019347285],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9768272,0.018455792,0.00080172834,0.0013875457,0.002109239,0.00041858017],"domain_scores_gemma":[0.9375639,0.05264603,0.0040766345,0.0021076796,0.0031186566,0.00048713578],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019795971,0.0005719605,0.00040462267,0.0034655011,0.003166936,0.004876461,0.0009263244,0.0011132371,0.0040571154],"category_scores_gemma":[0.05233043,0.00037016018,0.00042135132,0.002425843,0.014413855,0.009713382,0.0038872913,0.0020671948,0.00043224418],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019549248,0.00015302966,0.014223057,0.0005773575,0.000039581864,0.0007939358,0.34685284,0.0006128096,0.0017164083,0.57681435,0.0025959203,0.0554251],"study_design_scores_gemma":[0.00021260395,0.0004525708,0.040818382,0.0016026219,0.0002855868,0.0012193075,0.28807086,0.046435732,0.011438981,0.54411465,0.065166615,0.00018203068],"about_ca_topic_score_codex":0.0032345979,"about_ca_topic_score_gemma":0.002237376,"teacher_disagreement_score":0.019795971,"about_ca_system_score_codex":0.0045145736,"about_ca_system_score_gemma":0.0038927714,"threshold_uncertainty_score":0.10469234},"labels":[],"label_agreement":null},{"id":"W4391212444","doi":"10.48550/arxiv.2401.12566","title":"Automated Fact-Checking of Climate Change Claims with Large Language Models","year":2024,"lang":"en","type":"preprint","venue":"RePEc: Research Papers in Economics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; University of Oxford; Strong; Fetzer Institute; Institute for Catastrophic Loss Reduction; National Science Foundation","keywords":"Viewpoints; Skepticism; Perspective (graphical); Computer science; Scientific consensus; Climate science; Process (computing); Climate change; Denial; Data science; Interpretation (philosophy); Scientific evidence; Subject (documents); Management science; Engineering ethics; Epistemology; Global warming; Psychology; Artificial intelligence; Engineering","score_opus":0.08533069768617459,"score_gpt":0.42668538245514515,"score_spread":0.3413546847689706,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391212444","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04152285,0.00041797222,0.92101,0.0038127552,0.0001835149,0.000909926,0.004247967,0.021062905,0.0068321233],"genre_scores_gemma":[0.31314558,0.00019199676,0.6753748,0.00066227734,0.00013822784,0.0006317861,0.007103089,0.0009968439,0.0017554319],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9710731,0.01733192,0.0020944604,0.0030813992,0.0058627706,0.0005563487],"domain_scores_gemma":[0.765963,0.20315208,0.009254245,0.013605006,0.006697031,0.0013285931],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029069943,0.0013153421,0.0013719714,0.006161109,0.0021149062,0.0076322746,0.00376231,0.0023825238,0.008672443],"category_scores_gemma":[0.15729155,0.001153875,0.0033121235,0.0024509823,0.0025467046,0.009910656,0.007355753,0.0040932507,0.002308589],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013244288,0.0007473634,0.02572844,0.0023195478,0.0011126505,0.001992151,0.0088217,0.2878425,0.011942873,0.2532714,0.04346762,0.3614293],"study_design_scores_gemma":[0.000093356204,0.000045573048,0.0008567865,0.00015799834,0.000082144215,0.00012284814,0.00057718396,0.852817,0.004573947,0.12478997,0.01582205,0.00006110177],"about_ca_topic_score_codex":0.009510791,"about_ca_topic_score_gemma":0.01789323,"teacher_disagreement_score":0.029069943,"about_ca_system_score_codex":0.0029705523,"about_ca_system_score_gemma":0.0068610418,"threshold_uncertainty_score":0.15373838},"labels":[],"label_agreement":null},{"id":"W4391220979","doi":"10.1287/mksc.2023.0454","title":"Frontiers: Determining the Validity of Large Language Models for Automated Perceptual Analysis","year":2024,"lang":"en","type":"article","venue":"Marketing Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":131,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Perception; Computer science; Data science; Human language; Natural language processing; Language model; Artificial intelligence; Cognitive psychology; Machine learning; Econometrics; Economics; Psychology; Linguistics","score_opus":0.04878391879767375,"score_gpt":0.4075470857221072,"score_spread":0.35876316692443344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391220979","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28105086,0.0009882619,0.6962207,0.0017806994,0.00031999798,0.0007059227,0.0019249803,0.0056046015,0.011403962],"genre_scores_gemma":[0.87723815,0.00017475618,0.11904404,0.00023359794,0.0000911457,0.00041292323,0.0013903144,0.00046018983,0.0009548303],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9898239,0.007222359,0.00033487764,0.0011715563,0.0011293006,0.00031802664],"domain_scores_gemma":[0.84592766,0.14062746,0.0021105998,0.007041455,0.0032022623,0.0010905341],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014325748,0.0013133211,0.00090173876,0.0021639327,0.0013108673,0.0049835485,0.0017663327,0.0015985628,0.006755377],"category_scores_gemma":[0.10966139,0.00068533426,0.0012843553,0.0010111434,0.002497862,0.009420702,0.0038255681,0.0027832706,0.002140907],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0053868494,0.0015875882,0.034223314,0.0014125609,0.00060168095,0.0011029078,0.0072215735,0.16859575,0.031197786,0.11947209,0.024428602,0.60476923],"study_design_scores_gemma":[0.00014057632,0.00025032109,0.0026989016,0.00006518636,0.000047718513,0.00015768623,0.000760927,0.9137572,0.0036074712,0.07575272,0.0027112523,0.000050113318],"about_ca_topic_score_codex":0.0049652834,"about_ca_topic_score_gemma":0.0035094202,"teacher_disagreement_score":0.014325748,"about_ca_system_score_codex":0.0013432354,"about_ca_system_score_gemma":0.0017646562,"threshold_uncertainty_score":0.07576275},"labels":[],"label_agreement":null},{"id":"W4391255710","doi":"10.1017/dap.2023.48","title":"Inferring social networks from unstructured text data: A proof of concept detection of hidden communities of interest","year":2024,"lang":"en","type":"article","venue":"Data & Policy","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Construct (python library); Interpretation (philosophy); Computer science; Data science; Social network analysis; Social network (sociolinguistics); Domain (mathematical analysis); Epistemology; Sociology; World Wide Web; Social media; Mathematics","score_opus":0.2189809682701229,"score_gpt":0.43718231887640674,"score_spread":0.21820135060628384,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391255710","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.056618195,0.0003645011,0.93757457,0.0016812397,0.00009009602,0.00034597845,0.00070462207,0.000676363,0.0019444445],"genre_scores_gemma":[0.4419354,0.0002951453,0.5542225,0.00034348402,0.00023751386,0.00045198118,0.0013649991,0.00014355544,0.0010054645],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9917384,0.0039210264,0.0002827682,0.0018317298,0.0019620983,0.00026401746],"domain_scores_gemma":[0.8437502,0.13811184,0.005496804,0.005781113,0.005596224,0.0012638399],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013532002,0.0008642183,0.0011295845,0.0046645715,0.0018457798,0.003690147,0.002441909,0.002021076,0.0027641393],"category_scores_gemma":[0.0942715,0.00085781486,0.0013587757,0.002713554,0.0034392574,0.0059829527,0.0046000797,0.0039504375,0.0008341924],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000972084,0.0012511242,0.055738796,0.0016310251,0.0006461946,0.0028920525,0.0056992145,0.21814731,0.018693516,0.3601007,0.021910373,0.3123177],"study_design_scores_gemma":[0.00004794826,0.000038406888,0.0015941053,0.00008888628,0.000026701508,0.0002162879,0.0003060174,0.9175596,0.0017993267,0.07571832,0.002585103,0.000019334017],"about_ca_topic_score_codex":0.0024653429,"about_ca_topic_score_gemma":0.0033076846,"teacher_disagreement_score":0.013532002,"about_ca_system_score_codex":0.0009789696,"about_ca_system_score_gemma":0.0021081264,"threshold_uncertainty_score":0.07156491},"labels":[],"label_agreement":null},{"id":"W4391272168","doi":"10.48550/arxiv.2401.13805","title":"Longitudinal Sentiment Topic Modelling of Reddit Posts","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Pandemic; Coronavirus disease 2019 (COVID-19); Tone (literature); Social media; Longitudinal study; Gauge (firearms); Longitudinal data; 2019-20 coronavirus outbreak; Topic model; Sentiment analysis; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Psychology; Media studies; History; Sociology; World Wide Web; Computer science; Linguistics; Medicine; Information retrieval","score_opus":0.20240279438858752,"score_gpt":0.27429505765686124,"score_spread":0.07189226326827372,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391272168","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9456552,0.0010874291,0.032735318,0.0018165341,0.00022245637,0.00015412217,0.011018377,0.00029347723,0.007017068],"genre_scores_gemma":[0.9823558,0.00031038283,0.005953616,0.00010405838,0.00013905478,0.00013082713,0.0068402267,0.000040692565,0.0041253944],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992481,0.00028152618,0.00003727292,0.00017818328,0.00014492498,0.000109972534],"domain_scores_gemma":[0.995698,0.0028018923,0.00045566005,0.00017649848,0.0006988489,0.00016913241],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019577276,0.00045762182,0.00030548198,0.0016393391,0.00059652433,0.0012906448,0.00042227597,0.0005008197,0.0022028354],"category_scores_gemma":[0.0069954204,0.00014162551,0.00044623646,0.0016447009,0.00033320888,0.00085979886,0.00047165743,0.00082239846,0.0012585111],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015182168,0.00060822244,0.6512416,0.00079119246,0.00037002566,0.0008547205,0.012692014,0.03624591,0.025686018,0.010532505,0.03250592,0.22695366],"study_design_scores_gemma":[0.000041918684,0.0002313405,0.48331797,0.00013273806,0.0001623943,0.00028477682,0.006465371,0.46006557,0.0054205335,0.0071122074,0.036681704,0.00008348579],"about_ca_topic_score_codex":0.027977375,"about_ca_topic_score_gemma":0.04085001,"teacher_disagreement_score":0.027977375,"about_ca_system_score_codex":0.0010481228,"about_ca_system_score_gemma":0.0009531861,"threshold_uncertainty_score":0.055629075},"labels":[],"label_agreement":null},{"id":"W4391464262","doi":"10.1162/qss_a_00285","title":"Large-scale text analysis using generative language models: A case study in discovering public value expressions in AI patents","year":2024,"lang":"en","type":"article","venue":"Quantitative Science Studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; Biotechnology and Biological Sciences Research Council; Directorate for Biological Sciences; Snap","keywords":"Generative grammar; Natural language processing; Scale (ratio); Value (mathematics); Computer science; Generative model; Artificial intelligence; Linguistics; Machine learning; Geography; Cartography; Philosophy","score_opus":0.25531694364165575,"score_gpt":0.5238114656364624,"score_spread":0.26849452199480667,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391464262","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.46258208,0.0004235735,0.5261752,0.003677132,0.00004844311,0.0003389884,0.00087570574,0.0019821343,0.0038967219],"genre_scores_gemma":[0.77308,0.000108662585,0.22470868,0.00026245625,0.00004158982,0.0001624041,0.0007742187,0.00014394685,0.00071820896],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99233574,0.0058566844,0.0002286763,0.0005680568,0.00088404457,0.0001268321],"domain_scores_gemma":[0.8808862,0.11023903,0.0026419878,0.0036599543,0.0021685683,0.00040428503],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.009732377,0.00048070418,0.00039096785,0.0024772615,0.0011264408,0.001623267,0.0012117282,0.0012215036,0.0009783691],"category_scores_gemma":[0.038440026,0.0002860266,0.000910308,0.002155135,0.0020704907,0.002982442,0.0012794001,0.0019326498,0.0003083381],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006728482,0.0012933348,0.0704818,0.0008389166,0.0002853562,0.0050614835,0.01671035,0.27533424,0.030622063,0.11988041,0.016203418,0.46261588],"study_design_scores_gemma":[0.000054652275,0.00010442538,0.0059297676,0.000047308204,0.000036228692,0.00036051832,0.0013140085,0.92056894,0.0128338775,0.053010907,0.0056778346,0.00006151064],"about_ca_topic_score_codex":0.005144007,"about_ca_topic_score_gemma":0.0077174962,"teacher_disagreement_score":0.9975227,"about_ca_system_score_codex":0.0015546394,"about_ca_system_score_gemma":0.0011062288,"threshold_uncertainty_score":0.05147034},"labels":[],"label_agreement":null},{"id":"W4391807378","doi":"10.2196/preprints.57233","title":"Correction: Public Opinion About COVID-19 on a Microblog Platform in China: Topic Modeling and Multidimensional Sentiment Analysis of Social Media (Preprint)","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Preprint; Microblogging; Social media; Coronavirus disease 2019 (COVID-19); China; Public opinion; Sentiment analysis; Computer science; Data science; World Wide Web; Political science; Information retrieval; Artificial intelligence; Medicine; Law","score_opus":0.07536974956857688,"score_gpt":0.3912378599737713,"score_spread":0.3158681104051944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391807378","genre_codex":"editorial","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021477097,0.00040758855,0.002506888,0.11551145,0.8557209,0.000062908824,0.016695535,0.0016767011,0.0052703037],"genre_scores_gemma":[0.1633191,0.003536989,0.014020932,0.09020764,0.22692207,0.0008408889,0.031393252,0.0071541057,0.462605],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99510443,0.0007567889,0.00078467047,0.0008117286,0.002002349,0.00053997856],"domain_scores_gemma":[0.91448,0.018358352,0.0035726246,0.008946635,0.051573474,0.0030690038],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0050828164,0.0017823414,0.0018248787,0.0041437284,0.003356213,0.0040689395,0.002776361,0.005758665,0.11077515],"category_scores_gemma":[0.13511246,0.0010229908,0.0014519162,0.005158769,0.0021581827,0.003258233,0.0033641718,0.0061853174,0.04980071],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006878878,0.000007823593,0.00040762516,0.00016563834,0.00004143348,0.00021913067,0.00017168559,0.000101929516,0.00012811812,0.0015238066,0.99274796,0.0044161063],"study_design_scores_gemma":[0.00021013395,0.00005022346,0.008711584,0.00050633354,0.00016482375,0.00058068335,0.0006396206,0.0023772542,0.00146061,0.006215856,0.9789357,0.00014711871],"about_ca_topic_score_codex":0.027211472,"about_ca_topic_score_gemma":0.02355302,"teacher_disagreement_score":0.11077515,"about_ca_system_score_codex":0.0037749668,"about_ca_system_score_gemma":0.0062071662,"threshold_uncertainty_score":0.37057978},"labels":[],"label_agreement":null},{"id":"W4391807445","doi":"10.2196/57233","title":"Correction: Public Opinion About COVID-19 on a Microblog Platform in China: Topic Modeling and Multidimensional Sentiment Analysis of Social Media","year":2024,"lang":"en","type":"erratum","venue":"Journal of Medical Internet Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Social media; Microblogging; Sentiment analysis; Public opinion; Coronavirus disease 2019 (COVID-19); Computer science; China; Data science; Social media analytics; Internet privacy; World Wide Web; Political science; Artificial intelligence; Medicine; Politics","score_opus":0.15257090605438403,"score_gpt":0.49849722259818613,"score_spread":0.3459263165438021,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391807445","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002575065,0.00040316014,0.0009547729,0.08996968,0.9016901,0.000027336824,0.0034777687,0.00061451865,0.0026051842],"genre_scores_gemma":[0.032328326,0.0066622784,0.008892331,0.17681183,0.3816252,0.00045210475,0.009288247,0.003815005,0.3801247],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9948919,0.00077815366,0.0008405314,0.00065304764,0.0024328842,0.00040349795],"domain_scores_gemma":[0.95446473,0.012111752,0.0021258034,0.0025424259,0.026957327,0.001797953],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005495854,0.0027868727,0.0018934618,0.004313299,0.0040170257,0.003907521,0.003913678,0.007813079,0.06732931],"category_scores_gemma":[0.10101179,0.001176901,0.0018904652,0.0032848932,0.0032243305,0.0027852035,0.0028322157,0.010472664,0.037640672],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019681267,0.0000031154962,0.0000680954,0.000059019345,0.000008604343,0.00018224944,0.00004990845,0.000028139493,0.00002693486,0.0005390292,0.9969357,0.0020794412],"study_design_scores_gemma":[0.00006480308,0.000023506227,0.0011992168,0.00046865497,0.000058640926,0.00073666486,0.0002544434,0.00060558703,0.0004082451,0.0027988232,0.99330866,0.00007266785],"about_ca_topic_score_codex":0.042380825,"about_ca_topic_score_gemma":0.043634593,"teacher_disagreement_score":0.06732931,"about_ca_system_score_codex":0.0041913833,"about_ca_system_score_gemma":0.00767355,"threshold_uncertainty_score":0.22523898},"labels":[],"label_agreement":null},{"id":"W4392555130","doi":"10.5430/wjel.v14n3p253","title":"Linguistic Personality of the Marvel Cinematic Universe Character Nebula: Narrative and LIWC Analyses","year":2024,"lang":"en","type":"article","venue":"World Journal of English Language","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Character (mathematics); Narrative; Nebula; Personality; Psychology; Universe; Linguistics; Astrophysics; Social psychology; Philosophy; Physics; Stars; Mathematics; Geometry","score_opus":0.035406813504598275,"score_gpt":0.37973885238710875,"score_spread":0.34433203888251046,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392555130","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9959617,0.000065127904,0.00028818988,0.00006979878,0.0000034025954,0.000012321816,0.000036262212,0.0000033936383,0.0035597533],"genre_scores_gemma":[0.9988343,0.000052526146,0.00024900286,0.000013462558,0.000006552766,0.000012704299,0.000052230233,0.000003507162,0.0007756878],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992403,0.00044541882,0.000048600898,0.000088847475,0.00010604211,0.0000709029],"domain_scores_gemma":[0.995321,0.0024408174,0.0010117085,0.0002036662,0.00061180297,0.0004109982],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012905956,0.00014983298,0.0001279046,0.002146657,0.0009738759,0.002619538,0.00023029714,0.0002406649,0.0016645028],"category_scores_gemma":[0.00800836,0.00011917178,0.00011349003,0.001045578,0.0012608381,0.0009921654,0.0012542491,0.00039792238,0.00014301651],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018930118,0.00010687145,0.27379388,0.00013991164,0.000035545847,0.00075846806,0.6838496,0.00010362951,0.0071118656,0.0036071697,0.00063782185,0.02966592],"study_design_scores_gemma":[0.000004051669,0.00008597755,0.644754,0.00005065888,0.000020452855,0.0006283624,0.34535688,0.000678567,0.000979058,0.0007176295,0.006700385,0.000023960687],"about_ca_topic_score_codex":0.0023186908,"about_ca_topic_score_gemma":0.0031572836,"teacher_disagreement_score":0.002619538,"about_ca_system_score_codex":0.0007212826,"about_ca_system_score_gemma":0.00029863845,"threshold_uncertainty_score":0.0068253875},"labels":[],"label_agreement":null},{"id":"W4392603031","doi":"10.1097/md.0000000000037375","title":"Analysis of research topics and trends in investigator-initiated research/trials (IIRs/IITs): A topic modeling study","year":2024,"lang":"en","type":"article","venue":"Medicine","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Institutes of Health","keywords":"Medicine; MEDLINE; Research design; Physical therapy; Statistics","score_opus":0.7775671115340047,"score_gpt":0.672191371265809,"score_spread":0.10537574026819574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392603031","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7899938,0.035776425,0.13773493,0.0064192233,0.00041011526,0.0028808648,0.018210664,0.0007816351,0.007792289],"genre_scores_gemma":[0.9489074,0.0075403173,0.030687125,0.0003343109,0.00053800206,0.00204979,0.008581591,0.00013717666,0.0012244461],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.97459614,0.011836346,0.0039483225,0.004484764,0.004055354,0.0010790979],"domain_scores_gemma":[0.6732334,0.27695984,0.031428367,0.0056489087,0.01079221,0.0019372687],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.049745027,0.0013003543,0.0019827075,0.03025752,0.0011787708,0.0060700257,0.0016615022,0.0019577648,0.002549794],"category_scores_gemma":[0.1367172,0.0006277161,0.0064452807,0.035621233,0.0013666878,0.0054990863,0.0022888745,0.0019404762,0.0008434991],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00081383093,0.00035068055,0.84150827,0.0061172755,0.0028119253,0.0007593201,0.007219504,0.012437211,0.00141923,0.0111257825,0.0064508053,0.108986184],"study_design_scores_gemma":[0.00031143043,0.0009182958,0.59779197,0.0052991286,0.006739261,0.0030530735,0.012841661,0.2856732,0.003395154,0.04299159,0.040649995,0.00033522578],"about_ca_topic_score_codex":0.0043013766,"about_ca_topic_score_gemma":0.0028480997,"teacher_disagreement_score":0.9697425,"about_ca_system_score_codex":0.002905526,"about_ca_system_score_gemma":0.0043271715,"threshold_uncertainty_score":0.26308},"labels":[],"label_agreement":null},{"id":"W4392846024","doi":"10.1145/3625007.3627479","title":"Designing a Natural Language Processing System to Support Social Science Research","year":2023,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Natural (archaeology)","score_opus":0.17392387383116323,"score_gpt":0.5421152357581502,"score_spread":0.368191361926987,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392846024","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02240692,0.000058726488,0.91669106,0.0016655158,0.000139298,0.0077377376,0.0017822018,0.04380087,0.005717635],"genre_scores_gemma":[0.03564281,0.00005104674,0.9543703,0.00030776142,0.000043203072,0.003264075,0.0016909164,0.0014272993,0.0032025909],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.986389,0.0062440373,0.0020169353,0.0023629167,0.0025357697,0.00045129645],"domain_scores_gemma":[0.9444311,0.03983853,0.0018460675,0.005599044,0.0068856836,0.0013995593],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02343286,0.0009959713,0.0010558843,0.0035527423,0.0027925528,0.0059533287,0.0032653846,0.0025916067,0.01072761],"category_scores_gemma":[0.048152305,0.0016425912,0.0013710356,0.0020248871,0.0019166532,0.01088448,0.0053957105,0.0028441863,0.0076741963],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016819498,0.002937086,0.01767722,0.0049340255,0.00032913254,0.0057888646,0.034035336,0.017127354,0.19076173,0.07344515,0.07361606,0.5776661],"study_design_scores_gemma":[0.0007791184,0.0012462267,0.008232722,0.00085110276,0.0002022573,0.0027327063,0.005711805,0.34552184,0.13030434,0.07810104,0.42570183,0.00061498414],"about_ca_topic_score_codex":0.002024577,"about_ca_topic_score_gemma":0.0022257364,"teacher_disagreement_score":0.02343286,"about_ca_system_score_codex":0.0018418492,"about_ca_system_score_gemma":0.0048051532,"threshold_uncertainty_score":0.12392634},"labels":[],"label_agreement":null},{"id":"W4392943829","doi":"10.1109/icmla58977.2023.00292","title":"Advancing Multinomial Regression and Topic Modeling with Beta-Liouville Distributions","year":2023,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"BETA (programming language); Multinomial distribution; Multinomial logistic regression; Regression; Regression analysis; Beta distribution; Statistics; Computer science; Mathematics; Econometrics","score_opus":0.03981961002631524,"score_gpt":0.3762185067778122,"score_spread":0.336398896751497,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392943829","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047896164,0.00081316155,0.99207026,0.00075062556,0.000062076826,0.00002890568,0.00007669633,0.00020094909,0.0012076987],"genre_scores_gemma":[0.31145167,0.0040236106,0.67315817,0.001344707,0.0012202467,0.00058878656,0.0011415009,0.00068054145,0.0063907397],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98926044,0.007919197,0.0003048392,0.0012709363,0.00096026564,0.00028426602],"domain_scores_gemma":[0.9264733,0.066782355,0.0018193432,0.0021440524,0.0021659522,0.00061498594],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02229344,0.0015159762,0.002137777,0.003572233,0.001235831,0.005103792,0.0031067524,0.002707748,0.003220555],"category_scores_gemma":[0.08949465,0.0012494047,0.0026817292,0.0035630525,0.0023379414,0.006260987,0.003976381,0.0057687736,0.0022064869],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016846319,0.00014588202,0.00667084,0.0004367738,0.0002895058,0.00024853047,0.0013290078,0.4384407,0.0015105732,0.40183383,0.005075578,0.14385033],"study_design_scores_gemma":[0.000013768821,0.00001816372,0.0002453693,0.000055505712,0.000012889947,0.000041727162,0.000054101743,0.8524951,0.00023812192,0.14397423,0.0028286295,0.00002240718],"about_ca_topic_score_codex":0.008404834,"about_ca_topic_score_gemma":0.007777323,"teacher_disagreement_score":0.02229344,"about_ca_system_score_codex":0.0027691952,"about_ca_system_score_gemma":0.002513257,"threshold_uncertainty_score":0.11790037},"labels":[],"label_agreement":null},{"id":"W4393084754","doi":"10.22148/001c.92535","title":"Topic models indicate textual aboutness and pragmatics: Valuation practices in Islamophobic discourse","year":2024,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Pragmatics; Valuation (finance); Linguistics; Sociology; Computer science; Political science; Business; Philosophy; Accounting","score_opus":0.12967615831363632,"score_gpt":0.46276630122179513,"score_spread":0.3330901429081588,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393084754","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8562711,0.00082425383,0.10991419,0.0024933692,0.000054125292,0.00007667793,0.00018522477,0.00012981877,0.030051254],"genre_scores_gemma":[0.99335927,0.000119224,0.0057310592,0.000035022626,0.000020374231,0.000022958891,0.00005453509,0.000038143586,0.0006193063],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99509096,0.0036704002,0.00015793927,0.0004705551,0.0004542627,0.00015599414],"domain_scores_gemma":[0.95790535,0.036921732,0.002327128,0.0014030123,0.0010820231,0.00036077158],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008517079,0.00042194137,0.00032869988,0.002459497,0.001581022,0.006819416,0.0005403177,0.0008847029,0.0022489587],"category_scores_gemma":[0.03764804,0.00041191033,0.0003622791,0.0024734947,0.004891228,0.012071207,0.0033762755,0.0011341198,0.00029497963],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040199427,0.00008385943,0.040084336,0.00045251,0.00008686973,0.0006714486,0.597554,0.0030514277,0.006718838,0.2738528,0.0016004911,0.07544139],"study_design_scores_gemma":[0.000083914005,0.00020051438,0.07688997,0.00058990536,0.00017676683,0.0010740153,0.38022906,0.092338115,0.00573539,0.38897836,0.053510886,0.00019304059],"about_ca_topic_score_codex":0.0015912546,"about_ca_topic_score_gemma":0.001457299,"teacher_disagreement_score":0.008517079,"about_ca_system_score_codex":0.0017557497,"about_ca_system_score_gemma":0.00058924337,"threshold_uncertainty_score":0.04504311},"labels":[],"label_agreement":null},{"id":"W4393100941","doi":"10.1007/978-3-031-54752-2","title":"AI-Generated Popular Culture","year":2024,"lang":"en","type":"book","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Popular culture; Computer science; Sociology; Media studies","score_opus":0.04177498592570473,"score_gpt":0.38665588128832007,"score_spread":0.34488089536261535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393100941","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030301134,0.0017417063,0.00094228605,0.0037069437,0.0006052906,0.000010914517,0.000105702056,0.000060335813,0.9897967],"genre_scores_gemma":[0.13883442,0.0050681354,0.0021536432,0.0024017883,0.0007908833,0.00006907732,0.00046470205,0.00037235703,0.84984493],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9993525,0.00018034667,0.000015300358,0.000078577374,0.000290932,0.00008234257],"domain_scores_gemma":[0.9993761,0.00024160452,0.00003520943,0.00008330341,0.00015363866,0.00011002428],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006334646,0.00040527832,0.00025567785,0.0019305843,0.0040694806,0.0100849485,0.00081523124,0.001257471,0.06567901],"category_scores_gemma":[0.001954756,0.0001995015,0.0002741262,0.0025965318,0.00403849,0.0057196016,0.0031081883,0.0023984646,0.0106460955],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000012403373,0.000024437868,0.00021121526,0.00005982703,0.000004889569,0.000085071835,0.0048147943,0.0001109238,0.00017172105,0.84717727,0.10447466,0.04285285],"study_design_scores_gemma":[0.000004583025,0.0000062833037,0.00038625865,0.00008757474,0.0000030819283,0.00008891916,0.0027861593,0.00025594348,0.00023153042,0.08398104,0.91216236,0.000006276153],"about_ca_topic_score_codex":0.0037528726,"about_ca_topic_score_gemma":0.007671706,"teacher_disagreement_score":0.06567901,"about_ca_system_score_codex":0.0030267902,"about_ca_system_score_gemma":0.0014052684,"threshold_uncertainty_score":0.21971822},"labels":[],"label_agreement":null},{"id":"W4393102898","doi":"10.1007/978-3-031-54752-2_10","title":"AI and the Future of Pop Culture","year":2024,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Art","score_opus":0.01722701129694871,"score_gpt":0.34214838971782274,"score_spread":0.32492137842087404,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393102898","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007738952,0.049674135,0.036992453,0.030846225,0.0012117487,0.00003171191,0.00018653613,0.00020491458,0.8731134],"genre_scores_gemma":[0.4550279,0.07417915,0.048516195,0.0052400087,0.0026288794,0.00016785762,0.00042598022,0.00045059912,0.41336337],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9991405,0.0004886613,0.000018850613,0.00006285066,0.00023496138,0.000054116466],"domain_scores_gemma":[0.9976311,0.001892501,0.000053211545,0.00014795554,0.0001798759,0.00009547627],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011376364,0.00051478384,0.00033810415,0.0016814444,0.0017305386,0.0073440494,0.0008883736,0.0012028499,0.012294524],"category_scores_gemma":[0.0036700408,0.00017290855,0.00026557394,0.0022815492,0.008454804,0.006009942,0.0013498096,0.0023638043,0.0018541719],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000004281477,0.0000063017114,0.00012853045,0.0000814419,0.0000053698113,0.000020065376,0.001538504,0.00040452677,0.000073227035,0.9338484,0.011194152,0.05269518],"study_design_scores_gemma":[0.0000014404984,0.0000032872613,0.00025346404,0.00012398385,0.000002230824,0.000031496842,0.0015325643,0.0012784585,0.00014502039,0.81108934,0.18553177,0.000006910009],"about_ca_topic_score_codex":0.005663108,"about_ca_topic_score_gemma":0.008158849,"teacher_disagreement_score":0.012294524,"about_ca_system_score_codex":0.002584518,"about_ca_system_score_gemma":0.002225388,"threshold_uncertainty_score":0.04112929},"labels":[],"label_agreement":null},{"id":"W4393141458","doi":"10.1109/hpcc-dss-smartcity-dependsys60770.2023.00128","title":"Generalized Dirichlet-Multinomial Regression: Leveraging Arbitrary Features for Topic Modelling","year":2023,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Latent Dirichlet allocation; Multinomial distribution; Computer science; Dirichlet distribution; Regression; Multinomial logistic regression; Artificial intelligence; Topic model; Natural language processing; Econometrics; Statistics; Mathematics; Machine learning","score_opus":0.12900482532705285,"score_gpt":0.4064315621404358,"score_spread":0.2774267368133829,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393141458","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0034968017,0.0008098286,0.9941566,0.0002167717,0.000070431735,0.000055287037,0.00016788288,0.000463817,0.00056242925],"genre_scores_gemma":[0.2580275,0.003272618,0.72711325,0.00065352087,0.0008885298,0.0008211181,0.0028198294,0.0008885917,0.0055150506],"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99233633,0.005081093,0.00030491047,0.0013589904,0.0005851794,0.0003334463],"domain_scores_gemma":[0.99014837,0.0077020065,0.0004745639,0.0009546448,0.0005237437,0.00019670388],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010229935,0.0019969873,0.0030283474,0.0031618043,0.0010610224,0.0030214523,0.0040760064,0.0026942894,0.003089721],"category_scores_gemma":[0.02710301,0.0012873766,0.003354169,0.004763681,0.0015133078,0.0046259575,0.0031188487,0.0042118183,0.0025820287],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005129801,0.00023318699,0.006243709,0.0007640733,0.00061403523,0.00045275627,0.0011235273,0.45797163,0.0047112936,0.13825065,0.013215688,0.37590644],"study_design_scores_gemma":[0.000029994271,0.00002945396,0.00044629385,0.000051014722,0.00004125412,0.00013238902,0.000047216647,0.9292516,0.00056044024,0.064792335,0.0045740907,0.00004389544],"about_ca_topic_score_codex":0.0066715,"about_ca_topic_score_gemma":0.007663818,"teacher_disagreement_score":0.010229935,"about_ca_system_score_codex":0.0012124031,"about_ca_system_score_gemma":0.0018383556,"threshold_uncertainty_score":0.054101706},"labels":[],"label_agreement":null},{"id":"W4393865782","doi":"10.1007/s12134-024-01139-8","title":"Exploring Sixty-Two Years of Research on Immigrants’ Integration Using Structural Topic Modeling-Based Bibliometric Analysis","year":2024,"lang":"en","type":"article","venue":"Journal of International Migration and Integration / Revue de l integration et de la migration internationale","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; Université de Montréal","funders":"","keywords":"Immigration; Sociology; Regional science; Data science; Geography; Computer science; Archaeology","score_opus":0.22833178378618527,"score_gpt":0.48224182376243907,"score_spread":0.25391003997625383,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393865782","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9888164,0.0054918416,0.0004960857,0.000600467,0.000041648644,0.000032954267,0.0018761886,0.000016660577,0.0026278535],"genre_scores_gemma":[0.9908037,0.0034386076,0.00091804913,0.00010137534,0.00007167367,0.00009530354,0.0035768733,0.000014368882,0.0009799578],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.996498,0.0010531807,0.00082682207,0.00044224615,0.0008353594,0.00034445745],"domain_scores_gemma":[0.96852857,0.01761095,0.0067824917,0.0011600326,0.004434386,0.0014836045],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0071193483,0.00030530585,0.00075882435,0.02292464,0.0020396933,0.0037593532,0.0005824438,0.00083384704,0.0014353188],"category_scores_gemma":[0.023659844,0.0002553368,0.000986083,0.040884834,0.00086463173,0.0038147024,0.0035423099,0.00069707615,0.00038708164],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002483424,0.00017562731,0.7961268,0.0017497506,0.00068470207,0.0007062152,0.08605304,0.0005532605,0.0017919095,0.0032252371,0.0032269973,0.105458155],"study_design_scores_gemma":[0.000015347388,0.00016133493,0.89812875,0.0011057168,0.0005105722,0.00033838433,0.06173319,0.0010279528,0.000725991,0.0010975504,0.03509643,0.000058702753],"about_ca_topic_score_codex":0.014729265,"about_ca_topic_score_gemma":0.028609298,"teacher_disagreement_score":0.97707534,"about_ca_system_score_codex":0.0013925849,"about_ca_system_score_gemma":0.0036033068,"threshold_uncertainty_score":0.03765112},"labels":[],"label_agreement":null},{"id":"W4393875236","doi":"10.5281/zenodo.579547","title":"Rediscovery Datasets: Connecting Duplicate Reports Of Libreoffice And Gentoo","year":2017,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Computer science; Information retrieval","score_opus":0.06451699705648399,"score_gpt":0.3561331711343312,"score_spread":0.2916161740778472,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393875236","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0062446715,0.0004674298,0.00078756345,0.00024324034,0.00006030211,0.000089590794,0.98834616,0.001999343,0.0017616693],"genre_scores_gemma":[0.0025562134,0.00009149081,0.0013956846,0.00004826826,0.000010244711,0.00011046829,0.99518096,0.000118943404,0.00048766116],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9967141,0.00048325406,0.00048526668,0.00090718694,0.0010864765,0.0003237667],"domain_scores_gemma":[0.99255955,0.002133588,0.0010296883,0.0018730694,0.0018755085,0.0005286297],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020574557,0.001738684,0.0011305533,0.012335729,0.0013038353,0.0020283097,0.003164685,0.0024211349,0.00901198],"category_scores_gemma":[0.015428926,0.0005964965,0.0013755445,0.010207479,0.0007941634,0.0016080453,0.0036170494,0.0015588951,0.01177361],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027120006,0.00014403615,0.013743135,0.0017936277,0.00015769119,0.00033895776,0.00035967716,0.0013315382,0.0010897499,0.0024463004,0.95688534,0.02143884],"study_design_scores_gemma":[0.00036267485,0.00007716338,0.03648151,0.00059724017,0.000150708,0.00068977085,0.00069218955,0.0046994165,0.0031963603,0.0041020107,0.94883364,0.00011723817],"about_ca_topic_score_codex":0.032180633,"about_ca_topic_score_gemma":0.04619688,"teacher_disagreement_score":0.032180633,"about_ca_system_score_codex":0.0017617415,"about_ca_system_score_gemma":0.003770089,"threshold_uncertainty_score":0.06398666},"labels":[],"label_agreement":null},{"id":"W4394117380","doi":"10.6084/m9.figshare.6650921","title":"Dataset for: Modeling the random effects covariance matrix for longitudinal data with covariates measurement error","year":2018,"lang":"en","type":"dataset","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Covariate; Random effects model; Statistics; Covariance matrix; Covariance; Random error; Observational error; Longitudinal data; Computer science; Mixed model; Analysis of covariance; Econometrics; Mathematics; Data mining","score_opus":0.270558447041789,"score_gpt":0.44053483289611767,"score_spread":0.16997638585432867,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394117380","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012788676,0.00018127418,0.0034415761,0.00048131673,0.00010171888,0.00018559616,0.99237764,0.001299632,0.00065224763],"genre_scores_gemma":[0.004245501,0.00011991173,0.011426313,0.00020691601,0.000027736665,0.0012525853,0.98180425,0.000171446,0.0007454395],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980616,0.0007776184,0.00028179563,0.00042220255,0.00031572892,0.00014103462],"domain_scores_gemma":[0.9933646,0.0031121932,0.0005305136,0.0018873345,0.00081987196,0.00028543227],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0049182214,0.002342535,0.0012992419,0.0026303877,0.0010838815,0.0016103343,0.00528744,0.0032689716,0.034996957],"category_scores_gemma":[0.022507291,0.00064841716,0.002641104,0.0038471734,0.0005442729,0.0012098778,0.0025024833,0.0025941187,0.026049549],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033642,0.00017694342,0.0077961865,0.0017312919,0.0003574004,0.00016296998,0.00010281093,0.004545752,0.00034245496,0.0029124971,0.96170926,0.019826017],"study_design_scores_gemma":[0.0019288904,0.00015805973,0.023295408,0.0008349961,0.00027926822,0.0005691684,0.00021852409,0.015978953,0.0013367604,0.01835578,0.93687695,0.00016728703],"about_ca_topic_score_codex":0.012938772,"about_ca_topic_score_gemma":0.030298512,"teacher_disagreement_score":0.034996957,"about_ca_system_score_codex":0.0014494807,"about_ca_system_score_gemma":0.0027760682,"threshold_uncertainty_score":0.11707646},"labels":[],"label_agreement":null},{"id":"W4394383201","doi":"10.6084/m9.figshare.23294855.v1","title":"Dataset for Jiao et al., 2023.xlsx","year":2023,"lang":"en","type":"dataset","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; Western University","funders":"","keywords":"Physics","score_opus":0.21269377882659565,"score_gpt":0.49052051679388703,"score_spread":0.2778267379672914,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394383201","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00005006418,0.00003961411,0.00005461286,0.000057496276,0.000018848717,0.000012012836,0.99928576,0.00016539806,0.00031629647],"genre_scores_gemma":[0.0003049542,0.00006625665,0.0004664035,0.000077293626,0.000009222222,0.00018930179,0.998271,0.000103199454,0.0005124031],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989833,0.00019815871,0.00017873864,0.00035080785,0.00015046653,0.00013848042],"domain_scores_gemma":[0.99726474,0.0013409447,0.00022779247,0.00040447613,0.00055007276,0.00021202059],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012022852,0.0022663008,0.0014693037,0.003715672,0.0010738729,0.0027974863,0.002478289,0.0022837808,0.18312824],"category_scores_gemma":[0.008918892,0.00069682207,0.0018284955,0.005963838,0.00044599,0.0017190941,0.0019980625,0.0019457355,0.115806706],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007328014,0.00002349855,0.0008580011,0.0017359467,0.00004743882,0.000025092373,0.00003246479,0.00034555508,0.00010077366,0.0004902366,0.9934161,0.002851693],"study_design_scores_gemma":[0.00034998043,0.00002224559,0.0032593156,0.0005642371,0.00005988179,0.000049640432,0.00011131942,0.00042125292,0.00021501195,0.002068389,0.9928377,0.000040910007],"about_ca_topic_score_codex":0.016923876,"about_ca_topic_score_gemma":0.038150836,"teacher_disagreement_score":0.18312824,"about_ca_system_score_codex":0.00130674,"about_ca_system_score_gemma":0.0027778442,"threshold_uncertainty_score":0.612625},"labels":[],"label_agreement":null},{"id":"W4394411439","doi":"10.6084/m9.figshare.5202442","title":"Rachul et al. - Newspaper Article database.xlsx","year":2017,"lang":"en","type":"dataset","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Newspaper; Database; Computer science; Sociology; Media studies","score_opus":0.1378637855801718,"score_gpt":0.46682161468016187,"score_spread":0.32895782909999005,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394411439","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000097065145,0.000052022013,0.000030294841,0.00007131952,0.00002740314,0.000015843303,0.9991605,0.00017219102,0.00037339295],"genre_scores_gemma":[0.0006300958,0.00010169045,0.00038269177,0.00006989042,0.000025938547,0.00019914184,0.9974957,0.00010071614,0.0009940522],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987035,0.00022838623,0.00026062015,0.0003030934,0.00031545144,0.00018893678],"domain_scores_gemma":[0.99370825,0.0029780355,0.00082117383,0.0009980584,0.0010005396,0.0004939668],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015464054,0.0021882327,0.001418639,0.008085683,0.0007858445,0.004116254,0.0024314262,0.0021546008,0.22615826],"category_scores_gemma":[0.01504638,0.000605271,0.0018405793,0.008616289,0.0006177217,0.0018133051,0.0024156244,0.0017535841,0.16154203],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009937125,0.00003452614,0.0011094374,0.0021624472,0.000053972264,0.000036655714,0.000041587737,0.000180575,0.00008900449,0.0004444999,0.99239254,0.0033552996],"study_design_scores_gemma":[0.00041433488,0.00004055971,0.0052643702,0.0008452342,0.00007188911,0.00010310375,0.00014260132,0.0005034452,0.00030444976,0.001206707,0.991059,0.000044387187],"about_ca_topic_score_codex":0.010446308,"about_ca_topic_score_gemma":0.025829718,"teacher_disagreement_score":0.22615826,"about_ca_system_score_codex":0.0011307993,"about_ca_system_score_gemma":0.0026931316,"threshold_uncertainty_score":0.75657475},"labels":[],"label_agreement":null},{"id":"W4394557777","doi":"10.6084/m9.figshare.91828","title":"Full Text of 207 Reports from 1st Quarter of 2012 on Looted Heritage","year":2012,"lang":"en","type":"dataset","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Computer science; History; Mathematics; Archaeology","score_opus":0.06651378830431257,"score_gpt":0.35754322304648667,"score_spread":0.29102943474217413,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394557777","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007029637,0.00011956845,0.000083721374,0.00006131592,0.000032547472,0.000015629303,0.9969049,0.0003155089,0.001763946],"genre_scores_gemma":[0.0013162249,0.00009406954,0.0002659777,0.000023129896,0.00002333346,0.00006012521,0.99567837,0.00006785831,0.00247086],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9988875,0.00012527598,0.00015834057,0.0002579253,0.00042444814,0.00014660458],"domain_scores_gemma":[0.99647164,0.000941541,0.00051447126,0.00050256075,0.0012475462,0.00032229928],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008055123,0.0014320341,0.0008825164,0.010256765,0.0009254343,0.002136524,0.0011421862,0.000887906,0.05573173],"category_scores_gemma":[0.005785746,0.00044785772,0.0007039755,0.014258196,0.00031264446,0.0010846778,0.0014983824,0.00094492827,0.06227966],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000047681857,0.000014270793,0.0015990062,0.00046223856,0.000016847254,0.000044896286,0.00006753435,0.00015559595,0.00015325643,0.00022736898,0.99247414,0.0047370982],"study_design_scores_gemma":[0.00006884828,0.000014384379,0.017721038,0.0003009993,0.000039414423,0.000108722554,0.00040035052,0.00035812793,0.0007559267,0.00046302346,0.9797381,0.00003110465],"about_ca_topic_score_codex":0.03980112,"about_ca_topic_score_gemma":0.081193954,"teacher_disagreement_score":0.05573173,"about_ca_system_score_codex":0.0011048244,"about_ca_system_score_gemma":0.0030328552,"threshold_uncertainty_score":0.18644118},"labels":[],"label_agreement":null},{"id":"W4394755116","doi":"10.31235/osf.io/s4qdy","title":"The Social Structure of Scientific Evaluation: AI, Benchmarking, and the Deep Learning Monoculture","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"","keywords":"Benchmarking; Stage (stratigraphy); Set (abstract data type); Artificial intelligence; Epistemology; Computer science; Sociology; Philosophy; Economics; Management; Geology","score_opus":0.03424560798881055,"score_gpt":0.40343581215982965,"score_spread":0.3691902041710191,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394755116","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19895375,0.006559632,0.29579023,0.19136274,0.000884845,0.00033381948,0.00021232957,0.00060458435,0.30529806],"genre_scores_gemma":[0.9745043,0.00047071773,0.019215101,0.002349841,0.00020774754,0.00020680226,0.000035645728,0.00016093324,0.0028490103],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90623766,0.0688751,0.0024676567,0.0063783485,0.013111976,0.002929244],"domain_scores_gemma":[0.8399733,0.097002596,0.016802914,0.025254278,0.013237942,0.0077289613],"candidate_categories":["metaresearch","sts"],"consensus_categories":[],"category_scores_codex":[0.07247592,0.00075160176,0.00094194623,0.007872133,0.01317019,0.02090885,0.0023970923,0.0045009367,0.006468933],"category_scores_gemma":[0.11965749,0.0009317899,0.00061470893,0.0049174936,0.07852418,0.02685147,0.020430362,0.0066331998,0.0008564322],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000050805033,0.000051602587,0.004863569,0.00010522792,0.00003070237,0.00009969651,0.014759433,0.0010357221,0.000424663,0.9343043,0.0025920144,0.04168238],"study_design_scores_gemma":[0.000031272557,0.00004735066,0.0028757902,0.00023235392,0.000017441924,0.00006996185,0.0066081886,0.0040403735,0.0006473734,0.9490517,0.0363315,0.000046728095],"about_ca_topic_score_codex":0.004696734,"about_ca_topic_score_gemma":0.004792478,"teacher_disagreement_score":0.9868298,"about_ca_system_score_codex":0.015398315,"about_ca_system_score_gemma":0.012643573,"threshold_uncertainty_score":0.38329387},"labels":[],"label_agreement":null},{"id":"W4395027451","doi":"10.1109/comst.2024.3392642","title":"The Metaverse: Survey, Trends, Novel Pipeline Ecosystem &amp; Future Directions","year":2024,"lang":"en","type":"article","venue":"IEEE Communications Surveys & Tutorials","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"École de Technologie Supérieure; Concordia University; Polytechnique Montréal","funders":"","keywords":"Pipeline (software); Ecosystem; Environmental resource management; Computer science; Environmental science; Data science; Ecology; Biology","score_opus":0.1336653216643221,"score_gpt":0.42127118458580615,"score_spread":0.28760586292148405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4395027451","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01520511,0.8371115,0.027662344,0.053001374,0.0030588899,0.00029229565,0.0014715185,0.001262766,0.06093429],"genre_scores_gemma":[0.08928753,0.83538,0.04130668,0.010249344,0.0019926615,0.00041124364,0.003262341,0.0007593178,0.017350899],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99515873,0.0013829636,0.0006395439,0.00058722583,0.0015937835,0.00063769607],"domain_scores_gemma":[0.97540647,0.012420891,0.0022985882,0.001177649,0.006404391,0.0022920258],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012287363,0.0007940393,0.0007491508,0.010585391,0.0018715077,0.011663202,0.0022597138,0.002798535,0.012565468],"category_scores_gemma":[0.021024363,0.0007622154,0.0012194512,0.014247611,0.002741883,0.030723296,0.0055651884,0.0029430338,0.004052611],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011627449,0.00015718771,0.007186787,0.015026287,0.000047546968,0.00019941233,0.003253033,0.00058673153,0.001236496,0.09971292,0.06479354,0.8076837],"study_design_scores_gemma":[0.000007131546,0.00011878071,0.0023766544,0.008939995,0.00006403645,0.0006331875,0.004677708,0.0005972672,0.0007670869,0.012694777,0.96907455,0.000048809885],"about_ca_topic_score_codex":0.003434593,"about_ca_topic_score_gemma":0.005049976,"teacher_disagreement_score":0.012565468,"about_ca_system_score_codex":0.0032254555,"about_ca_system_score_gemma":0.011930993,"threshold_uncertainty_score":0.06498259},"labels":[],"label_agreement":null},{"id":"W4396237870","doi":"10.1007/s11192-024-05017-z","title":"CFMf topic-model: comparison with LDA and Top2Vec","year":2024,"lang":"en","type":"article","venue":"Scientometrics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Social Sciences and Humanities Research Council of Canada; Fonds de Recherche du Québec-Société et Culture; Canada Research Chairs","keywords":"Computer science; Topic model; Data science; Information retrieval","score_opus":0.08423497244561039,"score_gpt":0.45627159766623665,"score_spread":0.37203662522062625,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396237870","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34119245,0.023168277,0.5492099,0.003117439,0.0032395332,0.0010006109,0.025903717,0.030936377,0.022231795],"genre_scores_gemma":[0.72024125,0.0054151807,0.21465173,0.0004380302,0.0011723156,0.00068056805,0.044907343,0.0021228844,0.010370646],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9974137,0.0013220118,0.00014854516,0.00043643118,0.0004907686,0.00018855049],"domain_scores_gemma":[0.9932869,0.003920843,0.00017023164,0.000853373,0.0015244833,0.00024404681],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0056627514,0.001582748,0.0014517101,0.0057478403,0.0012653881,0.002206641,0.0011786709,0.0014547851,0.006297775],"category_scores_gemma":[0.013831391,0.00027354897,0.001375929,0.0043178336,0.00033730714,0.0038511357,0.001096023,0.0013114418,0.0042519597],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032933683,0.0010778194,0.016563945,0.0012113998,0.0013050188,0.00010494859,0.0003344045,0.06694724,0.0036361944,0.0051073893,0.07525824,0.8251601],"study_design_scores_gemma":[0.00022980126,0.0005426885,0.008341214,0.00011642385,0.00049131893,0.0002687766,0.00027790497,0.96534246,0.003012289,0.006543935,0.014726698,0.00010647808],"about_ca_topic_score_codex":0.025304213,"about_ca_topic_score_gemma":0.026029484,"teacher_disagreement_score":0.99425215,"about_ca_system_score_codex":0.0009614684,"about_ca_system_score_gemma":0.0027554347,"threshold_uncertainty_score":0.05031383},"labels":[{"model":"gemma","categories":["bibliometrics"],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W4398274863","doi":"10.7910/dvn/k0oyqf/hiqwhn","title":"canada200","year":2019,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Word (group theory); Ideology; Linguistics; Word length; Natural language processing; Computer science; Political science; Philosophy; Politics; Law","score_opus":0.04332124749979459,"score_gpt":0.34518139061962355,"score_spread":0.30186014311982895,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398274863","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00018372545,0.000054786797,0.00006201375,0.00005884445,0.000030547377,0.000011838896,0.99553347,0.00047500848,0.0035896443],"genre_scores_gemma":[0.0005819709,0.00007063166,0.0002548587,0.000084117644,0.000010038001,0.000042347016,0.99213845,0.00024329641,0.0065742307],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987399,0.00015157876,0.0000953264,0.0004055197,0.0003389451,0.0002686996],"domain_scores_gemma":[0.9959453,0.00058516074,0.0002271611,0.0011491459,0.0014306644,0.00066259166],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0010323662,0.0022222225,0.0013519078,0.0055490746,0.0021368219,0.003899917,0.002818478,0.0014589569,0.22786273],"category_scores_gemma":[0.006858706,0.0007818621,0.0010576078,0.010863523,0.0007254152,0.0010183705,0.0018475684,0.0014888863,0.266153],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005229689,0.000012367251,0.00036617,0.00013697598,0.000009303598,0.000009633223,0.000013961507,0.00008645924,0.00006064515,0.00043983606,0.9956781,0.0031341785],"study_design_scores_gemma":[0.000089536814,0.0000063830335,0.0019137218,0.000104199265,0.000014583333,0.00002141582,0.000058388876,0.0001882075,0.0002364957,0.0009105461,0.996439,0.000017463735],"about_ca_topic_score_codex":0.37911037,"about_ca_topic_score_gemma":0.5224187,"teacher_disagreement_score":0.7721373,"about_ca_system_score_codex":0.003938457,"about_ca_system_score_gemma":0.011037822,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4398293416","doi":"10.7910/dvn/6ffkri/2t8l8j","title":"Study2_Analysis.do","year":2020,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Replication (statistics); Business; Computer science; Biology; Virology","score_opus":0.04345078028204818,"score_gpt":0.3524240146506909,"score_spread":0.3089732343686427,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398293416","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00008333039,0.000030336063,0.00017944022,0.00008788233,0.000026693775,0.000071180344,0.99848974,0.00026181803,0.0007694471],"genre_scores_gemma":[0.002856226,0.00012987327,0.0029183317,0.00063515216,0.0000891443,0.0027966842,0.9837197,0.0013097367,0.0055451295],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986744,0.0003346143,0.00019556038,0.0003792523,0.00018953567,0.00022660555],"domain_scores_gemma":[0.98339266,0.010518504,0.0011629657,0.0017295803,0.002203822,0.0009925729],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.003983617,0.0018344772,0.0014200229,0.003898476,0.0011930969,0.00247345,0.002798145,0.0017688154,0.5937397],"category_scores_gemma":[0.024170827,0.0011903322,0.0018894946,0.0037766402,0.0004981704,0.0021329161,0.002581944,0.0016447174,0.1754249],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000102464866,0.0000335056,0.0013022189,0.0015224481,0.00006919677,0.000018396535,0.0000469836,0.00009769464,0.00007898118,0.0006984032,0.9936978,0.0023318892],"study_design_scores_gemma":[0.0022573196,0.00007151704,0.008760478,0.001302019,0.00022695879,0.00013186915,0.0002140801,0.0004723394,0.0004960551,0.005476889,0.9805043,0.00008621608],"about_ca_topic_score_codex":0.00983032,"about_ca_topic_score_gemma":0.024573628,"teacher_disagreement_score":0.4062603,"about_ca_system_score_codex":0.00137664,"about_ca_system_score_gemma":0.0034434013,"threshold_uncertainty_score":0.579481},"labels":[],"label_agreement":null},{"id":"W4398296029","doi":"10.7910/dvn/8ljgje/644uya","title":"metoo_project_dataset_2019_jan_mar_02.txt","year":2020,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Computer science; History; Archaeology","score_opus":0.046308983895244835,"score_gpt":0.3497279841323241,"score_spread":0.30341900023707924,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398296029","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00009817967,0.000024062878,0.00007822998,0.000079999976,0.000028268869,0.000013955788,0.99864274,0.00043956094,0.00059496274],"genre_scores_gemma":[0.00039822434,0.000031171032,0.0003398351,0.00006672435,0.000010801214,0.00012096192,0.9978319,0.00014566128,0.0010547931],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987361,0.0002700692,0.00014456382,0.00032762846,0.00029175333,0.0002299362],"domain_scores_gemma":[0.9964851,0.0010715704,0.0002988735,0.000838345,0.000864402,0.00044160784],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0018698678,0.0017515093,0.0010167912,0.003387941,0.0009709344,0.0029984687,0.0029110196,0.001872552,0.13479476],"category_scores_gemma":[0.01124805,0.0007246334,0.0011528949,0.005027045,0.0005594805,0.0013251695,0.0026227215,0.0016512963,0.12755023],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000035134733,0.000011409438,0.0003657837,0.00027044,0.000018237097,0.000009280372,0.000018287416,0.00012244738,0.00005054275,0.00046913972,0.9973367,0.0012924834],"study_design_scores_gemma":[0.00032391984,0.000019104757,0.002177973,0.00021024905,0.000027676766,0.000038416518,0.00009722703,0.00048853375,0.00032162937,0.0018984261,0.994369,0.000027867807],"about_ca_topic_score_codex":0.024328219,"about_ca_topic_score_gemma":0.048138496,"teacher_disagreement_score":0.8652052,"about_ca_system_score_codex":0.0015933856,"about_ca_system_score_gemma":0.0031089166,"threshold_uncertainty_score":0.4509334},"labels":[],"label_agreement":null},{"id":"W4398346520","doi":"10.7910/dvn/k0oyqf/b6ra1f","title":"goldstandard_uk.tab","year":2019,"lang":"zh","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Word (group theory); Ideology; Linguistics; Natural language processing; Computer science; Political science; Philosophy; Politics; Law","score_opus":0.042740541693988936,"score_gpt":0.3450376864225558,"score_spread":0.30229714472856684,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398346520","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00025878198,0.000081611135,0.00012885306,0.00008529282,0.000036200803,0.00002495666,0.9973436,0.0010511742,0.0009895032],"genre_scores_gemma":[0.0007040938,0.000050151513,0.00035307507,0.00006769257,0.000011307182,0.00012285511,0.997601,0.00021356788,0.0008762146],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980032,0.0003816011,0.0002740223,0.0005668652,0.00045815326,0.00031619883],"domain_scores_gemma":[0.995391,0.0015419252,0.0003635369,0.0014653207,0.0008709863,0.00036715402],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0021905683,0.0027972031,0.0015720505,0.0057498594,0.0012973425,0.0032919091,0.0040115598,0.0028182461,0.116310365],"category_scores_gemma":[0.011286903,0.0009287604,0.001529505,0.0062031853,0.0009948512,0.0016876928,0.0034746958,0.0019237073,0.14510295],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009271158,0.000022218846,0.00054429536,0.0007439994,0.000032234915,0.000018038145,0.000027746555,0.00015278764,0.00015169613,0.0004974968,0.99523675,0.0024799306],"study_design_scores_gemma":[0.0006807051,0.000053544078,0.004350432,0.00038043485,0.00006319085,0.000105973406,0.00012779166,0.00069121306,0.0010819581,0.0020721536,0.9903419,0.000050664745],"about_ca_topic_score_codex":0.016656088,"about_ca_topic_score_gemma":0.02833351,"teacher_disagreement_score":0.88368964,"about_ca_system_score_codex":0.0018987898,"about_ca_system_score_gemma":0.0027120484,"threshold_uncertainty_score":0.38909692},"labels":[],"label_agreement":null},{"id":"W4398350478","doi":"10.7910/dvn/k0oyqf/xiiru2","title":"main_results.py","year":2019,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Word (group theory); Ideology; Linguistics; Natural language processing; Word length; Computer science; Arithmetic; Artificial intelligence; Mathematics; Political science; Philosophy; Politics; Law","score_opus":0.04857831198870579,"score_gpt":0.36080049744726,"score_spread":0.31222218545855424,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398350478","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000098597,0.00007460955,0.00016402872,0.00015430307,0.000046881454,0.00002915086,0.996042,0.0018826444,0.0015077747],"genre_scores_gemma":[0.0010312729,0.00018345732,0.0013601268,0.00036514047,0.000044484572,0.00057121477,0.99178326,0.0017327729,0.0029283534],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980704,0.00043216275,0.00021126427,0.0006666572,0.00033119397,0.00028827012],"domain_scores_gemma":[0.9931873,0.003411012,0.00043553472,0.0015592598,0.0008159561,0.00059082534],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0035503088,0.0034340122,0.0021514078,0.004856306,0.0013170557,0.005524476,0.004467027,0.0028547295,0.36423862],"category_scores_gemma":[0.018790048,0.0010811769,0.002056158,0.0054403353,0.0009835693,0.0021790254,0.0041733626,0.0024921494,0.33690813],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000049520735,0.000018316052,0.00031283926,0.0007830545,0.000038572893,0.000011342064,0.00002339187,0.00009596815,0.00006632796,0.00048297024,0.9961767,0.0019410205],"study_design_scores_gemma":[0.00047628427,0.000021592292,0.0011452411,0.0003611879,0.000052408282,0.000037140115,0.000054477703,0.00036375353,0.00045289742,0.0033052042,0.99369663,0.000033171087],"about_ca_topic_score_codex":0.0071202656,"about_ca_topic_score_gemma":0.016135044,"teacher_disagreement_score":0.6357614,"about_ca_system_score_codex":0.0017793102,"about_ca_system_score_gemma":0.0029591506,"threshold_uncertainty_score":0.90683645},"labels":[],"label_agreement":null},{"id":"W4398357244","doi":"10.7910/dvn/k0oyqf/0imqrg","title":"table3.txt","year":2019,"lang":"it","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Word (group theory); Ideology; Linguistics; Computer science; Natural language processing; Political science; Politics; Law; Philosophy","score_opus":0.04743174483743739,"score_gpt":0.3381377997863732,"score_spread":0.2907060549489358,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398357244","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000042579995,0.000019493798,0.000052088915,0.000068966074,0.000027070035,0.000012908315,0.9987239,0.00036765845,0.00068522076],"genre_scores_gemma":[0.00040533615,0.00004894435,0.0003699956,0.00013584677,0.00002223372,0.0002017924,0.996838,0.00036461418,0.0016132217],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99807465,0.00033745012,0.00031983433,0.00058817724,0.00037132067,0.0003085588],"domain_scores_gemma":[0.99202675,0.0034686634,0.0006366872,0.0015705422,0.0015591922,0.00073808245],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0022757764,0.0025352451,0.0017719084,0.004978697,0.0015304915,0.005041868,0.0032840802,0.0021429565,0.38733232],"category_scores_gemma":[0.018035837,0.00091117574,0.0014426201,0.00833274,0.0007656493,0.0023199893,0.003169897,0.002620399,0.33962953],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000328564,0.0000121861885,0.00023114972,0.00037754656,0.000014147731,0.000008159198,0.000014258557,0.000057257017,0.00004620125,0.00027232483,0.99789584,0.0010379477],"study_design_scores_gemma":[0.0003370166,0.00002081284,0.0016030989,0.00029109692,0.000028911834,0.000036960395,0.00009749233,0.00022033605,0.00029586328,0.0022675388,0.99477345,0.000027456605],"about_ca_topic_score_codex":0.011358806,"about_ca_topic_score_gemma":0.022386337,"teacher_disagreement_score":0.6126677,"about_ca_system_score_codex":0.0017587118,"about_ca_system_score_gemma":0.0030779582,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4398395908","doi":"10.7910/dvn/lwfo6m/bv1a2h","title":"H&amp;G-Rep.csv","year":2011,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Replication (statistics); Cluster analysis; Computer science; Biology; Computational biology; Artificial intelligence; Virology","score_opus":0.08057140338969185,"score_gpt":0.36058883808658226,"score_spread":0.28001743469689044,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398395908","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00009246113,0.000040931594,0.00020883903,0.0001232262,0.00004881401,0.000027862763,0.9971801,0.001320919,0.0009568824],"genre_scores_gemma":[0.0005200343,0.000041562766,0.0010606048,0.00010855171,0.0000231745,0.00023286568,0.99586076,0.00078999344,0.0013624509],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99768984,0.0004788691,0.00025442347,0.000636667,0.0005304466,0.00040976997],"domain_scores_gemma":[0.9918944,0.0019177671,0.00057810044,0.0032257156,0.0014538975,0.00093002414],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003930218,0.003039245,0.001937139,0.0058675744,0.001924015,0.004239791,0.0068633,0.0030975507,0.23954259],"category_scores_gemma":[0.022590548,0.0011772055,0.0022903385,0.0067078304,0.0013373833,0.0020174666,0.004294771,0.0034984464,0.30575988],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000029402141,0.000013611179,0.00023455686,0.00022009858,0.000016117912,0.0000076664455,0.000017786591,0.000089618065,0.000041590472,0.00042331533,0.9979417,0.0009645216],"study_design_scores_gemma":[0.0004057208,0.000018789382,0.0015342893,0.00024321447,0.000041946314,0.000045778954,0.00008553311,0.0004931151,0.000538389,0.0037208854,0.99283206,0.00004036728],"about_ca_topic_score_codex":0.014058537,"about_ca_topic_score_gemma":0.033013374,"teacher_disagreement_score":0.7604574,"about_ca_system_score_codex":0.0017744824,"about_ca_system_score_gemma":0.0046651047,"threshold_uncertainty_score":0.80134976},"labels":[],"label_agreement":null},{"id":"W4398440537","doi":"10.7910/dvn/dus88v","title":"2019 Canadian Election Study (CES) - Online Survey","year":2020,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; Toronto Metropolitan University; Université du Québec à Montréal; Western University","funders":"","keywords":"Geography","score_opus":0.06690661034692758,"score_gpt":0.36536528463518897,"score_spread":0.2984586742882614,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398440537","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00048489863,0.000031624215,0.00004542843,0.000084997846,0.000019777646,0.000051188617,0.9979443,0.00007738271,0.0012604288],"genre_scores_gemma":[0.001431506,0.0000505382,0.00036022757,0.000105974694,0.000010228346,0.0002579744,0.99562776,0.000041015777,0.0021147232],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9981185,0.00021518704,0.00019020676,0.00031918503,0.00076673727,0.00039008434],"domain_scores_gemma":[0.99235207,0.0005420208,0.0003920514,0.00068756007,0.0052494686,0.0007768366],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019134487,0.0013139115,0.0011548393,0.0039848527,0.0030344953,0.0021892157,0.0030355947,0.0011090084,0.038124975],"category_scores_gemma":[0.01098672,0.0005603258,0.0008057718,0.009186035,0.0004455158,0.00072513876,0.0019473092,0.0018045126,0.02519728],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006107078,0.00002052932,0.0025777929,0.00015461307,0.000023054277,0.00001908418,0.000041983298,0.000075095704,0.000030666408,0.0004099269,0.99457586,0.0020103103],"study_design_scores_gemma":[0.00033489545,0.000024320389,0.071622595,0.00038171033,0.00007079558,0.000057902143,0.00041295463,0.00057915866,0.00029401152,0.0007367489,0.92539024,0.000094667215],"about_ca_topic_score_codex":0.90317273,"about_ca_topic_score_gemma":0.9582323,"teacher_disagreement_score":0.09682727,"about_ca_system_score_codex":0.012408647,"about_ca_system_score_gemma":0.02805713,"threshold_uncertainty_score":0.19479495},"labels":[],"label_agreement":null},{"id":"W4398502327","doi":"10.7910/dvn/bh6csq","title":"Towards a Data-Driven Theory of Narrativity","year":2023,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Narrativity; Computer science; Philosophy; Linguistics; Narrative","score_opus":0.10078636440652755,"score_gpt":0.3818303228155828,"score_spread":0.2810439584090553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398502327","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0062078633,0.00041501873,0.017861184,0.0022879448,0.00023508722,0.00025285673,0.96387476,0.0014825528,0.0073826998],"genre_scores_gemma":[0.019473342,0.00016429309,0.022485778,0.00032881452,0.000060205854,0.0008045711,0.95426863,0.0001597724,0.0022545988],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9969146,0.0015012708,0.00034795434,0.00061531353,0.00048586007,0.00013493602],"domain_scores_gemma":[0.9890822,0.005349679,0.00071931555,0.0026772702,0.0017939408,0.0003774827],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00533842,0.0010375348,0.0006508528,0.0038404164,0.001208902,0.003332617,0.002997092,0.00156489,0.016742796],"category_scores_gemma":[0.033253744,0.00040310057,0.00096174097,0.0034199676,0.000855535,0.0026339805,0.003050331,0.0022222784,0.01950321],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002731421,0.00012972832,0.0119270915,0.0013063349,0.00011359683,0.00008148464,0.00070471555,0.0020919326,0.0006615895,0.01725187,0.93381023,0.03164817],"study_design_scores_gemma":[0.000304808,0.000080116995,0.020782072,0.0007811729,0.00010646857,0.00023351413,0.002219399,0.023393292,0.001942409,0.07138637,0.8786814,0.00008897801],"about_ca_topic_score_codex":0.009043086,"about_ca_topic_score_gemma":0.017911708,"teacher_disagreement_score":0.016742796,"about_ca_system_score_codex":0.0018503201,"about_ca_system_score_gemma":0.0023423766,"threshold_uncertainty_score":0.056010246},"labels":[],"label_agreement":null},{"id":"W4398562377","doi":"10.7910/dvn/dus88v/rzfnov","title":"2019 Canadian Election Study - Online Survey v1.0.dta","year":2020,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; Toronto Metropolitan University; Université du Québec à Montréal; Western University","funders":"","keywords":"Business","score_opus":0.0707055351119945,"score_gpt":0.3676686501804858,"score_spread":0.29696311506849127,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398562377","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00009585559,0.000012910649,0.00003373211,0.000040731167,0.000008179147,0.000018769288,0.9992543,0.0000702821,0.00046519007],"genre_scores_gemma":[0.0008487924,0.00003436914,0.00032109075,0.00007256364,0.000009202673,0.00021680305,0.9967175,0.00006478369,0.0017149396],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9983523,0.0002312817,0.00017542508,0.00026250147,0.00053945545,0.00043907325],"domain_scores_gemma":[0.99001515,0.0016742182,0.00066177,0.0014249575,0.005238263,0.0009857279],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021429618,0.0016621114,0.0012476405,0.0053320257,0.0023199066,0.0021979297,0.0044772383,0.0014463457,0.12005234],"category_scores_gemma":[0.016422646,0.00088007987,0.0011140858,0.011666694,0.00052652805,0.0007478031,0.0019040446,0.0017596947,0.043302856],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000036448033,0.000008205027,0.0010077214,0.00016584455,0.00001715437,0.000009745152,0.00001726211,0.00011476065,0.000014191084,0.00038049128,0.99709797,0.0011302694],"study_design_scores_gemma":[0.00045882902,0.000015825835,0.022556566,0.00044584085,0.00007189008,0.000044968612,0.00018609577,0.00057997,0.00023113436,0.001166138,0.97417766,0.000065144224],"about_ca_topic_score_codex":0.85803485,"about_ca_topic_score_gemma":0.92959297,"teacher_disagreement_score":0.14196515,"about_ca_system_score_codex":0.011468791,"about_ca_system_score_gemma":0.030506354,"threshold_uncertainty_score":0.40161508},"labels":[],"label_agreement":null},{"id":"W4398618100","doi":"10.7910/dvn/k0oyqf/iw3uit","title":"tableA3.txt","year":2019,"lang":"it","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Word (group theory); Ideology; Linguistics; Computer science; Natural language processing; Mathematics; Political science; Philosophy; Politics; Law","score_opus":0.04761380894429166,"score_gpt":0.33793949339536516,"score_spread":0.2903256844510735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398618100","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000040258652,0.000016690845,0.000052355077,0.000066171786,0.00002316468,0.000010778147,0.9988776,0.00039797786,0.0005149428],"genre_scores_gemma":[0.00045361082,0.00004589972,0.00040458742,0.00013851239,0.000022320237,0.00022425242,0.99697137,0.00040529107,0.0013340885],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9981046,0.00033063695,0.00031431124,0.0005443561,0.00038434015,0.00032172652],"domain_scores_gemma":[0.9902778,0.004532581,0.0008134564,0.0018630328,0.0016334963,0.000879549],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0023096732,0.0026087775,0.0017316738,0.0053263893,0.0014792306,0.0051602274,0.0035734656,0.0024509076,0.3852552],"category_scores_gemma":[0.01984367,0.0009838453,0.0016370291,0.008586642,0.0008170514,0.0020969152,0.0032446384,0.0027048627,0.3119236],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000039902592,0.000013932416,0.0002584925,0.00043459525,0.000019909794,0.000009321492,0.000017120321,0.000071848575,0.000052100946,0.00031732296,0.9977245,0.0010410068],"study_design_scores_gemma":[0.00043736168,0.000023604933,0.001879131,0.000353682,0.000040571096,0.00003885921,0.00009286506,0.00028642805,0.00034528063,0.0028184894,0.99364954,0.000034195255],"about_ca_topic_score_codex":0.012243333,"about_ca_topic_score_gemma":0.022440119,"teacher_disagreement_score":0.6147448,"about_ca_system_score_codex":0.0017160494,"about_ca_system_score_gemma":0.0032600686,"threshold_uncertainty_score":0.87685883},"labels":[],"label_agreement":null},{"id":"W4398620518","doi":"10.7910/dvn/8ljgje/yep0md","title":"metoo_project_dataset_2019_jan_mar_01.txt","year":2020,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Art; Art history; Computer graphics (images); History; Computer science; Archaeology","score_opus":0.04615046193653554,"score_gpt":0.34936761350449724,"score_spread":0.3032171515679617,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398620518","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00009813909,0.000024100047,0.000077634926,0.000080674516,0.000028139986,0.000014209945,0.9986594,0.00042510094,0.0005926751],"genre_scores_gemma":[0.0004054393,0.000031452782,0.0003449999,0.000068177695,0.000010887842,0.00012598606,0.9978017,0.00014452227,0.0010668739],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987356,0.00027197367,0.00014663165,0.00032578068,0.00029070192,0.00022916924],"domain_scores_gemma":[0.9964568,0.0010930495,0.00030397557,0.00084144255,0.0008653737,0.00043930433],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001872577,0.0017284524,0.0010069122,0.0033563182,0.0009752974,0.0029780113,0.0028992763,0.0018830623,0.13696878],"category_scores_gemma":[0.011384253,0.00071834703,0.0011474704,0.0049567455,0.000555405,0.0013105826,0.0026261515,0.0016479715,0.12746598],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000034953096,0.0000114634395,0.00036277564,0.00027500058,0.00001812677,0.00000919737,0.000018269917,0.00012159397,0.00004976856,0.00047220223,0.9973398,0.0012868844],"study_design_scores_gemma":[0.00032703317,0.000019250838,0.0021868516,0.00021695456,0.000027858168,0.000038852024,0.00009784757,0.00048673744,0.00031804366,0.001907082,0.9943455,0.00002803054],"about_ca_topic_score_codex":0.024268242,"about_ca_topic_score_gemma":0.04831836,"teacher_disagreement_score":0.8630312,"about_ca_system_score_codex":0.0016024039,"about_ca_system_score_gemma":0.0031337214,"threshold_uncertainty_score":0.45820618},"labels":[],"label_agreement":null},{"id":"W4399732070","doi":"10.22148/001c.116223","title":"Racio-national Imaginary and Discursive Formation of Arabo-Islamic Identity in al-Manār and al-Risālah: A Topic Modeling Study","year":2024,"lang":"en","type":"article","venue":"Journal of Cultural Analytics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Qatar National Research Fund; Fonds National de la Recherche Luxembourg; Qatar Foundation","keywords":"Conceptualization; Intelligentsia; Islam; The Imaginary; Modernity; Identity (music); Politics; Sociology; Gender studies; National identity; Religious studies; Media studies; Linguistics; Political science; Law; Psychoanalysis; Philosophy; Theology; Aesthetics; Psychology","score_opus":0.05478203777936157,"score_gpt":0.4321214697361947,"score_spread":0.3773394319568331,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399732070","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96232563,0.0011235869,0.013580267,0.002968028,0.00006693621,0.00009849302,0.00024199991,0.00004767506,0.019547412],"genre_scores_gemma":[0.99420446,0.00048287763,0.0027613244,0.0000848337,0.00004118024,0.000058951635,0.00013129742,0.000027599843,0.0022075567],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9979108,0.0013388555,0.0000784302,0.00024379091,0.00025435656,0.00017377615],"domain_scores_gemma":[0.99290997,0.005851669,0.0004842179,0.00025826896,0.0003257489,0.00017016071],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054070153,0.00037223703,0.00036649642,0.0027797034,0.0037073074,0.0074040825,0.0008857078,0.0011399665,0.0017253205],"category_scores_gemma":[0.006941221,0.00032740697,0.0005726107,0.0033218076,0.0038380437,0.0065053445,0.0025456462,0.0012385035,0.0002994339],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015786341,0.00019282395,0.042214688,0.00027045663,0.000050248684,0.00076862593,0.79266536,0.0016419824,0.0010588744,0.12791389,0.0025491363,0.03051608],"study_design_scores_gemma":[0.000020305228,0.00007449519,0.03044113,0.000291567,0.00006170069,0.00052596955,0.85312134,0.031058319,0.0015485768,0.029263742,0.053534806,0.000058086385],"about_ca_topic_score_codex":0.011218,"about_ca_topic_score_gemma":0.011101463,"teacher_disagreement_score":0.011218,"about_ca_system_score_codex":0.0037473442,"about_ca_system_score_gemma":0.0019432416,"threshold_uncertainty_score":0.028595388},"labels":[],"label_agreement":null},{"id":"W4399855246","doi":"10.18280/isi.290320","title":"Cluster Visualized Topic Modeling Paradigms for Recognition of Health-Related Topics Through a Machine Learning","year":2024,"lang":"en","type":"article","venue":"Ingénierie des systèmes d information","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Cluster (spacecraft); Computer science; Artificial intelligence; Data science; Machine learning; Human–computer interaction","score_opus":0.07075774891010754,"score_gpt":0.37218146614178355,"score_spread":0.301423717231676,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399855246","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006379881,0.0011870799,0.9874063,0.00091790716,0.00013308549,0.00020611464,0.0008194668,0.0012399518,0.00171019],"genre_scores_gemma":[0.3323604,0.0022475543,0.6493741,0.0006536509,0.0007738467,0.0014614143,0.0040967264,0.0005945529,0.008437718],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9964449,0.0013428055,0.0002569513,0.0011787789,0.000527443,0.00024915385],"domain_scores_gemma":[0.9909961,0.005612067,0.00090190733,0.0010983357,0.001001111,0.00039048473],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0051287194,0.0014803488,0.0014221253,0.006602708,0.0014987884,0.0034970916,0.0030057158,0.0019202176,0.0062162],"category_scores_gemma":[0.0136500215,0.000724975,0.002995451,0.005461688,0.0013943725,0.004723271,0.0028330295,0.003078841,0.0026758385],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00076520967,0.000430661,0.018710751,0.0011746393,0.0007762147,0.00055841054,0.0046513784,0.19686624,0.011834352,0.2415415,0.028567115,0.4941235],"study_design_scores_gemma":[0.00004154968,0.000078870835,0.0022067092,0.00008227786,0.00008461936,0.00017729242,0.00047194865,0.8286122,0.002068418,0.14575075,0.020352818,0.00007247091],"about_ca_topic_score_codex":0.011751709,"about_ca_topic_score_gemma":0.013646145,"teacher_disagreement_score":0.011751709,"about_ca_system_score_codex":0.0027492035,"about_ca_system_score_gemma":0.0023197809,"threshold_uncertainty_score":0.02712363},"labels":[],"label_agreement":null},{"id":"W4400529059","doi":"10.1145/3626772.3661362","title":"Reflections on the Coding Ability of LLMs for Analyzing Market Research Surveys","year":2024,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Coding (social sciences); Market research; Data science; Computer science; Business; Marketing; Social science; Sociology","score_opus":0.44929753710859904,"score_gpt":0.5977982595760435,"score_spread":0.14850072246744445,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400529059","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.064443894,0.0038009381,0.71320504,0.1972889,0.0008875272,0.0002734329,0.0020692954,0.0014946365,0.016536241],"genre_scores_gemma":[0.52012926,0.0016302083,0.455438,0.014140957,0.001712655,0.0007487107,0.0013396256,0.0013450728,0.0035154454],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.8547095,0.124167375,0.0039055631,0.005582637,0.010327156,0.0013077932],"domain_scores_gemma":[0.265463,0.6651448,0.0062750485,0.042897552,0.01800097,0.0022186823],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16153704,0.0012529537,0.00097353914,0.0046899198,0.0021517936,0.012741828,0.0041026035,0.0040240316,0.0055716843],"category_scores_gemma":[0.4899532,0.0011594334,0.0016765194,0.0034837138,0.017535014,0.022133812,0.0065811216,0.01124682,0.002276228],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038537395,0.00020706617,0.026710592,0.00073983334,0.00029801327,0.00016791119,0.019096656,0.019833315,0.0031696537,0.6602178,0.038946576,0.23022725],"study_design_scores_gemma":[0.00006856336,0.00011905785,0.006649991,0.0009085847,0.000054813405,0.00027121097,0.0061489614,0.19763644,0.0047250013,0.7356653,0.04753209,0.00021980464],"about_ca_topic_score_codex":0.0142441355,"about_ca_topic_score_gemma":0.009379117,"teacher_disagreement_score":0.16153704,"about_ca_system_score_codex":0.006172147,"about_ca_system_score_gemma":0.0047519132,"threshold_uncertainty_score":0.8542997},"labels":[],"label_agreement":null},{"id":"W4400835982","doi":"10.61784/wjit3001","title":"SUMMAGAN: ENHANCING WEB NEWS SUMMARIZATION THROUGH GENERATIVE ADVERSARIAL NETWORKS","year":2024,"lang":"en","type":"article","venue":"World Journal of Information Technology ","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Automatic summarization; Adversarial system; Generative grammar; Computer science; Generative adversarial network; World Wide Web; Information retrieval; Artificial intelligence; Deep learning","score_opus":0.01302985140628786,"score_gpt":0.3145772466450879,"score_spread":0.30154739523880003,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400835982","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017735304,0.0009091952,0.97165525,0.0003822997,0.00018385919,0.0001082915,0.00045591945,0.0051934356,0.0033765207],"genre_scores_gemma":[0.59178746,0.0011151267,0.38612378,0.0009685164,0.00037334824,0.0003888344,0.0038494973,0.0011013512,0.014292203],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99954754,0.00017523959,0.000021983287,0.00011228079,0.000105187326,0.000037812548],"domain_scores_gemma":[0.9987413,0.0008190172,0.00010131889,0.00014364053,0.00015238587,0.000042304287],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010682605,0.0012008883,0.00063933886,0.0006330485,0.00026046095,0.00075858866,0.00097151543,0.00066197716,0.0025073302],"category_scores_gemma":[0.0036346966,0.00030767912,0.0006372359,0.00050002645,0.0004027564,0.0013550384,0.0010403359,0.0015333067,0.0011806333],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019774739,0.00011327197,0.0009432011,0.00024093398,0.0001419465,0.00022207906,0.00019466617,0.72233695,0.018248346,0.0093431305,0.010255306,0.23776244],"study_design_scores_gemma":[0.000013087921,0.00006608211,0.00014007417,0.0000129352065,0.000019443487,0.00003669915,0.00001638054,0.9858591,0.0049005877,0.0060228696,0.0029021732,0.000010536618],"about_ca_topic_score_codex":0.0017174197,"about_ca_topic_score_gemma":0.003237183,"teacher_disagreement_score":0.0025073302,"about_ca_system_score_codex":0.00049903773,"about_ca_system_score_gemma":0.00043621816,"threshold_uncertainty_score":0.008387864},"labels":[],"label_agreement":null},{"id":"W4400977443","doi":"10.1371/journal.pone.0302457","title":"Streamlining Canadian parliamentary data access: A user-friendly R package","year":2024,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"École Nationale d'Administration Publique","funders":"","keywords":"Open government; Open data; Openness to experience; Commons; Government (linguistics); Computer science; Flexibility (engineering); Data science; Scalability; World Wide Web; User Friendly; Adaptability; Process (computing); Metadata; Data curation; Political science; Database","score_opus":0.21223642202330287,"score_gpt":0.39907863705956925,"score_spread":0.18684221503626638,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400977443","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008431337,0.0008444881,0.4665226,0.005251916,0.0011097157,0.0016969163,0.11770408,0.3823124,0.016126506],"genre_scores_gemma":[0.062803715,0.00074530253,0.7326063,0.003220556,0.00026279857,0.0075294995,0.060122937,0.12029262,0.012416356],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98923826,0.0054386854,0.0007699214,0.001634207,0.002216956,0.0007020407],"domain_scores_gemma":[0.92739666,0.050819475,0.003134604,0.008847094,0.008183179,0.0016188796],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022845756,0.0025695858,0.0016963764,0.004213195,0.0018279204,0.005178406,0.0033195997,0.0011600715,0.051380664],"category_scores_gemma":[0.1372403,0.0018881282,0.003306878,0.005192749,0.0018949106,0.0030002098,0.0056846077,0.0034567877,0.027474182],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010013486,0.0000992113,0.015036683,0.0024529463,0.0014767934,0.0006650982,0.0017069754,0.010580939,0.002806982,0.031917986,0.82664514,0.105609864],"study_design_scores_gemma":[0.0010924202,0.00015615064,0.014374631,0.0009094468,0.0006624429,0.00059462315,0.0006521783,0.08964051,0.008081135,0.05265735,0.83072215,0.00045688273],"about_ca_topic_score_codex":0.08522428,"about_ca_topic_score_gemma":0.14988486,"teacher_disagreement_score":0.9147757,"about_ca_system_score_codex":0.004173765,"about_ca_system_score_gemma":0.023527818,"threshold_uncertainty_score":0.17188543},"labels":[],"label_agreement":null},{"id":"W4401042368","doi":"10.18653/v1/2024.naacl-long.128","title":"First Tragedy, then Parse: History Repeats Itself in the New Era of Large Language Models","year":2024,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Samsung; York University; Samsung Advanced Institute of Technology","keywords":"Parsing; Tragedy (event); Computer science; Natural language processing; Linguistics; Artificial intelligence; Literature; Philosophy; Art","score_opus":0.05173172708515712,"score_gpt":0.35860151697430104,"score_spread":0.30686978988914393,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401042368","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013989037,0.12256841,0.20210524,0.60304624,0.0076622195,0.00006006091,0.0024513185,0.0045557576,0.04356172],"genre_scores_gemma":[0.4487328,0.11309697,0.22863218,0.1071547,0.022757798,0.00047162396,0.0052461247,0.015480636,0.05842727],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9934448,0.0033707141,0.0003148507,0.0010822678,0.0015339709,0.00025331267],"domain_scores_gemma":[0.9420582,0.042055976,0.00096084777,0.009361784,0.0041221697,0.0014410072],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018580323,0.00083992525,0.0015251574,0.0024769786,0.0040617613,0.011823289,0.0029111262,0.004958698,0.01180967],"category_scores_gemma":[0.0709222,0.0015318117,0.000623129,0.0033989793,0.01778393,0.07509678,0.0075589144,0.012964137,0.007643414],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033633414,0.000068104906,0.0024363815,0.00047250467,0.00010872759,0.00022455906,0.004531654,0.0026719477,0.0005365972,0.47679573,0.23809531,0.2737221],"study_design_scores_gemma":[0.000025314845,0.000027157883,0.00051537465,0.0003690776,0.000036088793,0.00025033677,0.001034154,0.008443809,0.0006906755,0.6918125,0.29669264,0.00010290992],"about_ca_topic_score_codex":0.007673459,"about_ca_topic_score_gemma":0.010408314,"teacher_disagreement_score":0.018580323,"about_ca_system_score_codex":0.0029118047,"about_ca_system_score_gemma":0.003342775,"threshold_uncertainty_score":0.09826326},"labels":[],"label_agreement":null},{"id":"W4401798876","doi":"10.1093/oxfordhb/9780197653609.013.35","title":"How Machine Learning Is Reviving Sociological Theorization","year":2024,"lang":"en","type":"book-chapter","venue":"Oxford University Press eBooks","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Sociology; Epistemology; Sociological theory; Sociological research; Social science; Cognitive science; Psychology; Philosophy","score_opus":0.051849507256803304,"score_gpt":0.27988671860200603,"score_spread":0.22803721134520272,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401798876","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021765694,0.028027954,0.23784064,0.35748228,0.0031371466,0.000064337466,0.0002518396,0.000608018,0.35082203],"genre_scores_gemma":[0.8100987,0.018521156,0.1091201,0.018641181,0.004783152,0.00024491313,0.0003232434,0.0008692378,0.03739821],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9918391,0.0055518188,0.00019109865,0.0005765888,0.0016249241,0.00021647313],"domain_scores_gemma":[0.96307594,0.030911785,0.00060847076,0.0035013873,0.0014774177,0.00042497757],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.014521038,0.0006604783,0.0007484605,0.0037906973,0.0021026304,0.012104177,0.0025607063,0.0034760148,0.005709117],"category_scores_gemma":[0.021318942,0.00046919225,0.0006257724,0.0022241052,0.04372991,0.019312605,0.0035248436,0.0065113576,0.0017133394],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006600788,0.000012769958,0.00013507453,0.000071070666,0.000008672625,0.000039511244,0.0020502221,0.0009388826,0.00007307239,0.9793352,0.004494385,0.012834723],"study_design_scores_gemma":[0.0000033990686,0.0000030982362,0.000072756084,0.000115663715,0.0000022191712,0.000021007594,0.00047436228,0.001951919,0.0001061887,0.96627396,0.030968362,0.0000070831056],"about_ca_topic_score_codex":0.002223717,"about_ca_topic_score_gemma":0.0021388838,"teacher_disagreement_score":0.9978974,"about_ca_system_score_codex":0.0045118504,"about_ca_system_score_gemma":0.002670997,"threshold_uncertainty_score":0.07679546},"labels":[],"label_agreement":null},{"id":"W4401827640","doi":"10.3389/frai.2024.1401782","title":"Exploring artificial intelligence techniques to research low energy nuclear reactions","year":2024,"lang":"en","type":"review","venue":"Frontiers in Artificial Intelligence","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"York University; Anthropocene Institute; George Washington University","keywords":"Computer science; Latent Dirichlet allocation; Data science; Population; Energy (signal processing); Artificial intelligence; Topic model; Physics; Sociology","score_opus":0.5375093439296857,"score_gpt":0.5176849984329847,"score_spread":0.01982434549670109,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401827640","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.079991125,0.0068124337,0.8844051,0.005874147,0.00039716304,0.00040912803,0.0017344588,0.0024696295,0.017906854],"genre_scores_gemma":[0.38594797,0.005016851,0.5985619,0.0008194265,0.00043781192,0.0008011999,0.0039649564,0.00034778047,0.004102141],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99562174,0.0028443623,0.00025533407,0.00057779206,0.0005872064,0.00011359342],"domain_scores_gemma":[0.9801824,0.017205114,0.00083643966,0.0009796879,0.00064176106,0.00015470231],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005396568,0.0009549714,0.00053103414,0.004517626,0.0011336457,0.003217475,0.0011418266,0.0010826591,0.0027241572],"category_scores_gemma":[0.020292794,0.000399767,0.0011756909,0.0040867343,0.0016257361,0.0057073846,0.002186478,0.0025215428,0.0012601641],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025458215,0.0005851819,0.010890785,0.0020812778,0.0003244828,0.00030803002,0.005412066,0.069268696,0.015911385,0.13171357,0.013151861,0.75009805],"study_design_scores_gemma":[0.000060601804,0.00018778334,0.005738542,0.000348878,0.0001225059,0.00026495467,0.0026428578,0.67038846,0.012073505,0.24123012,0.0668512,0.00009066168],"about_ca_topic_score_codex":0.0015982016,"about_ca_topic_score_gemma":0.0029105118,"teacher_disagreement_score":0.005396568,"about_ca_system_score_codex":0.0010932519,"about_ca_system_score_gemma":0.0010802591,"threshold_uncertainty_score":0.028540134},"labels":[],"label_agreement":null},{"id":"W4401830459","doi":"10.1123/ssj.2023-0206","title":"Concussion Reporting and Racial Stereotypes: ESPN’s Role in Shaping Public Perception About Athletes of Color","year":2024,"lang":"en","type":"article","venue":"Sociology of Sport Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Concussion; Athletes; Perception; Psychology; Advertising; Injury prevention; Medicine; Physical therapy; Poison control; Medical emergency; Business; Neuroscience","score_opus":0.06680623419222308,"score_gpt":0.3982355043447936,"score_spread":0.3314292701525705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401830459","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9664211,0.00029138333,0.0007534976,0.0039333995,0.0000865229,0.000046965884,0.00014532593,0.000009741691,0.02831199],"genre_scores_gemma":[0.99695504,0.00027677612,0.00045668278,0.00065080554,0.00006907522,0.00004378061,0.00007181844,0.000015610634,0.001460324],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.99245137,0.005038773,0.00031166486,0.00052084104,0.0011061192,0.0005713341],"domain_scores_gemma":[0.9644835,0.024651833,0.005482913,0.0012241402,0.003309877,0.00084760075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011659893,0.0003180602,0.00021069232,0.0035750484,0.004402679,0.007703592,0.00072920026,0.0009236267,0.0033454753],"category_scores_gemma":[0.034285292,0.00025818654,0.00022883023,0.0026772337,0.0056490204,0.004105632,0.0038737697,0.0015055592,0.0003086095],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000101946105,0.00007201222,0.09135095,0.0001523349,0.000022035012,0.00031524876,0.876533,0.000043353215,0.0008663684,0.0061069923,0.0014881878,0.022947636],"study_design_scores_gemma":[0.0000054263223,0.000037377835,0.068260625,0.0004193535,0.000021203416,0.0001399407,0.9119526,0.0002969296,0.000643771,0.0015210888,0.016677774,0.00002389124],"about_ca_topic_score_codex":0.018762067,"about_ca_topic_score_gemma":0.02649347,"teacher_disagreement_score":0.018762067,"about_ca_system_score_codex":0.0036524676,"about_ca_system_score_gemma":0.0026911215,"threshold_uncertainty_score":0.061664104},"labels":[],"label_agreement":null},{"id":"W4402029985","doi":"10.31235/osf.io/uyegs","title":"The Age of AI Nationalism and Its Effects","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nationalism; Political science; History; Politics; Law","score_opus":0.03426219231609736,"score_gpt":0.41516935808194316,"score_spread":0.3809071657658458,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402029985","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021263931,0.029114898,0.002836218,0.42126012,0.0040746033,0.000015067674,0.00023232114,0.00014624446,0.5210566],"genre_scores_gemma":[0.7706151,0.034871735,0.003497773,0.13356945,0.008703047,0.00014100879,0.00023694814,0.0004335088,0.047931273],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9956318,0.001795609,0.00013205758,0.0008255391,0.000926861,0.0006881569],"domain_scores_gemma":[0.9845317,0.008394223,0.0012322945,0.0016133786,0.0016838321,0.0025445556],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009655186,0.0004414364,0.0005360924,0.0018856954,0.008026499,0.012270316,0.0009963927,0.005331285,0.019636681],"category_scores_gemma":[0.014671318,0.0003422055,0.000552312,0.0016080522,0.03300439,0.020098738,0.008883594,0.012280277,0.0024655329],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003410107,0.00003222712,0.0011745632,0.00006340612,0.000010393208,0.00005755343,0.004403083,0.00008725811,0.00005869456,0.93833387,0.035438992,0.020305876],"study_design_scores_gemma":[0.000021439913,0.000030302792,0.0028820736,0.00045353343,0.000011780731,0.00018170581,0.006314012,0.00016448395,0.00015528491,0.32828516,0.66146505,0.000035139852],"about_ca_topic_score_codex":0.009781086,"about_ca_topic_score_gemma":0.007562843,"teacher_disagreement_score":0.019636681,"about_ca_system_score_codex":0.0060841506,"about_ca_system_score_gemma":0.005090297,"threshold_uncertainty_score":0.06569129},"labels":[],"label_agreement":null},{"id":"W4402163574","doi":"10.37074/jalt.2024.7.2.32","title":"Exploring the synergy of human and AI-driven approaches in thematic analysis for qualitative educational research","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Learning & Teaching","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"TD Bank","keywords":"Thematic analysis; Qualitative research; Qualitative analysis; Thematic map; Sociology; Psychology; Computer science; Geography; Social science; Cartography","score_opus":0.4928765214947675,"score_gpt":0.5282736162722501,"score_spread":0.035397094777482596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402163574","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039427795,0.0004882332,0.94574994,0.0029475642,0.00009641142,0.0027068318,0.00020083482,0.00029121616,0.0080912355],"genre_scores_gemma":[0.24262214,0.0003254128,0.74834,0.00059829035,0.000028192144,0.0069894283,0.00011939588,0.00015472033,0.0008223516],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.72750294,0.25637785,0.00412069,0.004621807,0.0063104928,0.0010662829],"domain_scores_gemma":[0.43762225,0.5179876,0.010521418,0.021398533,0.010916343,0.0015539144],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.26291594,0.0012775431,0.0009934457,0.007705952,0.004108649,0.010699697,0.003647255,0.0015159313,0.006107213],"category_scores_gemma":[0.32852826,0.0011499095,0.0014542076,0.0055601113,0.016144175,0.011772881,0.013276524,0.0026477277,0.00086002133],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036787568,0.00025134344,0.009689936,0.0052690026,0.00027694635,0.00047695017,0.5399925,0.004987593,0.006611244,0.2074831,0.0020784382,0.22251499],"study_design_scores_gemma":[0.000382281,0.00056910346,0.006651819,0.006123424,0.00026141136,0.0008674664,0.21992965,0.06425423,0.014382002,0.6099482,0.07629116,0.00033921897],"about_ca_topic_score_codex":0.0025904914,"about_ca_topic_score_gemma":0.0086764125,"teacher_disagreement_score":0.73708403,"about_ca_system_score_codex":0.009007679,"about_ca_system_score_gemma":0.012645329,"threshold_uncertainty_score":0.9089559},"labels":[],"label_agreement":null},{"id":"W4402335544","doi":"10.1101/2024.09.06.24313186","title":"Loon Lens 1.0 Validation: Agentic AI for Title and Abstract Screening in Systematic Literature Reviews","year":2024,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Systematic review; Lens (geology); Through-the-lens metering; Psychology; Data science; Political science; Computer science; MEDLINE; Law; Physics; Optics","score_opus":0.1130685049969929,"score_gpt":0.41761191198380937,"score_spread":0.3045434069868165,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402335544","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.064900845,0.050451364,0.29606608,0.022399832,0.0077350168,0.2800934,0.15643018,0.07721622,0.044707146],"genre_scores_gemma":[0.08671686,0.0055311616,0.5828732,0.0037030703,0.0009158144,0.2949849,0.013833424,0.006230012,0.0052115615],"study_design_codex":"systematic_review","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.660534,0.18831904,0.10014397,0.020672038,0.027073612,0.0032572192],"domain_scores_gemma":[0.24256617,0.56849456,0.07842966,0.039216086,0.06871958,0.0025739719],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3382286,0.004477708,0.011028644,0.036930464,0.0035132791,0.015677873,0.005584319,0.004934898,0.053129222],"category_scores_gemma":[0.64675343,0.0047925464,0.018002732,0.028659074,0.004064401,0.011803651,0.008327414,0.0033953455,0.009438296],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008077057,0.00038612456,0.027741197,0.5292333,0.024369597,0.0011868423,0.0102266995,0.0026322913,0.0057209507,0.014058179,0.1652552,0.21111253],"study_design_scores_gemma":[0.024510507,0.003750338,0.06455503,0.24377915,0.073957674,0.0035563065,0.006123499,0.03622419,0.013615003,0.04280851,0.4840033,0.003116448],"about_ca_topic_score_codex":0.003579027,"about_ca_topic_score_gemma":0.012153934,"teacher_disagreement_score":0.6617714,"about_ca_system_score_codex":0.00701594,"about_ca_system_score_gemma":0.04095824,"threshold_uncertainty_score":0.81608194},"labels":[],"label_agreement":null},{"id":"W4402391272","doi":"10.23889/ijpds.v9i5.2864","title":"Exploring Text Classification Systems for Automatically Coding Historical Occupations and Causes of Death","year":2024,"lang":"en","type":"article","venue":"International Journal for Population Data Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Guelph","funders":"Economic and Social Research Council","keywords":"Coding (social sciences); Computer science; Natural language processing; Information retrieval; Data science; Sociology; Social science","score_opus":0.5370092133463087,"score_gpt":0.5151466273038554,"score_spread":0.02186258604245328,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402391272","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5845052,0.0014522811,0.36393872,0.0059475075,0.0004996965,0.0010211206,0.018593851,0.011591168,0.01245059],"genre_scores_gemma":[0.6658837,0.0004860923,0.29335424,0.0004149774,0.00016243164,0.0006180666,0.032616355,0.00018219903,0.0062819594],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9985649,0.00065330626,0.00010936653,0.0003177505,0.00025815915,0.00009652933],"domain_scores_gemma":[0.9912151,0.005972859,0.00057833735,0.000583188,0.0014534167,0.00019712288],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035527502,0.0008375276,0.00027437723,0.0031353068,0.00067232177,0.0016031585,0.0012321937,0.0008746814,0.0031638488],"category_scores_gemma":[0.013262233,0.00019949122,0.0005238021,0.0022692806,0.00033805726,0.0027599311,0.0009893521,0.001083647,0.0017397609],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044977452,0.0011550369,0.091574065,0.000535043,0.00015163796,0.00036959467,0.0019345791,0.06278778,0.0062170043,0.0069564595,0.051210135,0.77665895],"study_design_scores_gemma":[0.00007831906,0.00021841674,0.020238874,0.00015320898,0.00007506794,0.000113595175,0.0016953516,0.9342946,0.008859804,0.011414762,0.02280478,0.00005318699],"about_ca_topic_score_codex":0.023492849,"about_ca_topic_score_gemma":0.03366634,"teacher_disagreement_score":0.023492849,"about_ca_system_score_codex":0.0018728897,"about_ca_system_score_gemma":0.0015811935,"threshold_uncertainty_score":0.04671222},"labels":[],"label_agreement":null},{"id":"W4402396493","doi":"10.54066/jptis.v2i3.2382","title":"Application of Clustering Methods on Sexual Harassment Cases","year":2024,"lang":"en","type":"article","venue":"Jurnal Penelitian Teknologi Informasi dan Sains","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Harassment; Cluster analysis; Psychology; Computer science; Social psychology; Artificial intelligence","score_opus":0.0635895238062754,"score_gpt":0.435802601567955,"score_spread":0.37221307776167956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402396493","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8002063,0.0018673022,0.1700671,0.0024341291,0.0006983907,0.0020994034,0.007804511,0.0018686855,0.012954276],"genre_scores_gemma":[0.8405919,0.00051266403,0.14822486,0.00009558649,0.0001415205,0.0005748767,0.0070233974,0.00010127923,0.002733924],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.995203,0.0022717104,0.0005335481,0.000801646,0.0009268383,0.0002633151],"domain_scores_gemma":[0.98416555,0.010247178,0.0009450218,0.0009873151,0.003337264,0.00031765067],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047308807,0.0009317137,0.00075506663,0.011144329,0.0020885426,0.0019236534,0.0012538788,0.0012318816,0.0023641393],"category_scores_gemma":[0.02120128,0.00026541497,0.0014091992,0.0056383144,0.0005718368,0.0009230742,0.0012199426,0.0010652783,0.0007783081],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010260717,0.0017181296,0.1376001,0.0015799309,0.0010928181,0.0016323335,0.0066663288,0.12135451,0.0039053222,0.00791554,0.032003567,0.68350536],"study_design_scores_gemma":[0.00011395936,0.00035764216,0.087907195,0.0003805143,0.0004618445,0.0006621554,0.011355012,0.8619819,0.0068032867,0.014485125,0.015308039,0.00018334623],"about_ca_topic_score_codex":0.016743988,"about_ca_topic_score_gemma":0.014124127,"teacher_disagreement_score":0.016743988,"about_ca_system_score_codex":0.0017185654,"about_ca_system_score_gemma":0.0016270656,"threshold_uncertainty_score":0.03329307},"labels":[],"label_agreement":null},{"id":"W4402423783","doi":"10.24908/iqurcp18003","title":"Markov Genealogy Processes","year":2024,"lang":"en","type":"article","venue":"Inquiry Queen s Undergraduate Research Conference Proceedings","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Genealogy; Markov chain; Mathematics; History; Statistics","score_opus":0.1805118572688633,"score_gpt":0.4748035968186588,"score_spread":0.2942917395497955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402423783","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13182583,0.0011032562,0.841407,0.0027511618,0.000104013685,0.00024969655,0.002050031,0.0005085247,0.020000562],"genre_scores_gemma":[0.89648986,0.0020758065,0.08273127,0.00039890085,0.00016012412,0.0006155208,0.0019951435,0.000097514814,0.01543601],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9989236,0.00041330786,0.000055201734,0.00029921537,0.00021282276,0.00009584343],"domain_scores_gemma":[0.99060225,0.0071463636,0.0008834307,0.00072390935,0.00046819288,0.00017580883],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032912241,0.00037076374,0.00059612223,0.0013347225,0.00068638986,0.0017414038,0.0013589897,0.0010843002,0.006441092],"category_scores_gemma":[0.0143904295,0.0003510445,0.000874259,0.0011503958,0.0017017421,0.0034379552,0.0010008881,0.0013508738,0.0008726602],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000035240762,0.000031697407,0.0060017346,0.00007672138,0.000056556666,0.00024505367,0.00065187836,0.14165446,0.00048852846,0.8332748,0.0022377227,0.015245579],"study_design_scores_gemma":[0.000025908741,0.000026858275,0.0020560331,0.000042751097,0.000026721793,0.00013165125,0.00010247868,0.5304411,0.00017243355,0.4613105,0.005636858,0.00002673306],"about_ca_topic_score_codex":0.005849101,"about_ca_topic_score_gemma":0.0052079842,"teacher_disagreement_score":0.006441092,"about_ca_system_score_codex":0.0015057778,"about_ca_system_score_gemma":0.0010021968,"threshold_uncertainty_score":0.021547556},"labels":[],"label_agreement":null},{"id":"W4402441103","doi":"10.1111/jbfa.12834","title":"Verifiable content in social media stock‐analysis articles: The long and short of it","year":2024,"lang":"en","type":"article","venue":"Journal of Business Finance &amp Accounting","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fundamental Research Funds for the Central Universities; Southwestern University of Finance and Economics; Jinan University; Canadian Intensive Care Foundation; Houston Advanced Research Center","keywords":"Verifiable secret sharing; Content (measure theory); Social media; Content analysis; Stock (firearms); Computer science; Internet privacy; Sociology; World Wide Web; Mathematics; Engineering; Social science; Programming language","score_opus":0.10209183470795792,"score_gpt":0.36054535363493995,"score_spread":0.25845351892698204,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402441103","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9855618,0.0007317227,0.0019236562,0.0009969819,0.00009188407,0.00006707051,0.0010879836,0.00004283614,0.009496068],"genre_scores_gemma":[0.9977012,0.00013500232,0.00072781777,0.00007203785,0.0001690722,0.000022429516,0.00030238667,0.000016554237,0.000853344],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9940614,0.0018769925,0.0008369725,0.00053869846,0.0023634937,0.00032242373],"domain_scores_gemma":[0.62217695,0.26665238,0.084124975,0.0088509815,0.015861636,0.0023330743],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0071241665,0.00029262446,0.0003461739,0.0039867456,0.00068630587,0.0042273724,0.0004953201,0.0009824327,0.008579602],"category_scores_gemma":[0.11316571,0.00020404393,0.00035629218,0.0031448384,0.0012465216,0.0051262234,0.0012626402,0.001060606,0.00086372264],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003400095,0.0005585927,0.82364243,0.0013612688,0.0006657212,0.0011825364,0.008100803,0.001913535,0.014136616,0.012053476,0.0040376857,0.1289472],"study_design_scores_gemma":[0.00008185043,0.00061006594,0.93368334,0.0005874102,0.0005108032,0.00082331704,0.0070439135,0.012807316,0.017563665,0.014223987,0.011923373,0.00014084231],"about_ca_topic_score_codex":0.0016286667,"about_ca_topic_score_gemma":0.0022222667,"teacher_disagreement_score":0.008579602,"about_ca_system_score_codex":0.0010046058,"about_ca_system_score_gemma":0.00062326685,"threshold_uncertainty_score":0.037676692},"labels":[],"label_agreement":null},{"id":"W4402552828","doi":"10.1057/s41268-024-00335-4","title":"Placing machine learning into the hermeneutic circle: a combined computational-interpretive method for text analysis","year":2024,"lang":"en","type":"article","venue":"Journal of International Relations and Development","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"International political economy; International relations; Development studies; International studies; Epistemology; Sociology; Social science; Political science; Philosophy; Politics","score_opus":0.017474944328519655,"score_gpt":0.3696908922903049,"score_spread":0.35221594796178524,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402552828","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0034389247,0.000111929476,0.9921153,0.00089298584,0.00007532837,0.00016783692,0.00012856923,0.0006798643,0.0023892764],"genre_scores_gemma":[0.07708904,0.00011696849,0.91981936,0.00021587458,0.00015375658,0.00047543956,0.0002504805,0.0003092862,0.0015698471],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9768174,0.016664729,0.0011655131,0.0020655422,0.0030012247,0.00028555453],"domain_scores_gemma":[0.94214016,0.04572577,0.0022814253,0.005615949,0.0035544345,0.0006822051],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013987985,0.0010494931,0.0011112129,0.0075094295,0.0027979864,0.011060773,0.0023416525,0.0015786167,0.0071308212],"category_scores_gemma":[0.066027954,0.00070715055,0.0014977426,0.0051984545,0.0077779265,0.008669304,0.006209985,0.003436459,0.0023113592],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020425173,0.00027959413,0.0029243552,0.0005769218,0.000114117494,0.00018225994,0.011541506,0.0059761424,0.005053712,0.49473262,0.00673255,0.471682],"study_design_scores_gemma":[0.000050931398,0.000069698406,0.0013393685,0.00027525783,0.00005398345,0.00019505073,0.0026829045,0.19809066,0.0050132787,0.7638655,0.028247694,0.0001157317],"about_ca_topic_score_codex":0.0020705813,"about_ca_topic_score_gemma":0.00290123,"teacher_disagreement_score":0.013987985,"about_ca_system_score_codex":0.0016885849,"about_ca_system_score_gemma":0.005387393,"threshold_uncertainty_score":0.07397646},"labels":[],"label_agreement":null},{"id":"W4402585440","doi":"10.3390/info15090573","title":"Exploring Players’ Perspectives: A Comprehensive Topic Modeling Case Study on Elden Ring","year":2024,"lang":"en","type":"article","venue":"Information","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Tech University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Ring (chemistry); Psychology; Chemistry","score_opus":0.3131305822500731,"score_gpt":0.42431334809292287,"score_spread":0.11118276584284975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402585440","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97092664,0.000265382,0.021726493,0.0008875333,0.00003204653,0.00017301556,0.00030995006,0.00015429042,0.005524688],"genre_scores_gemma":[0.9800521,0.00017723326,0.014781876,0.000111270376,0.000027062617,0.000097373355,0.00037199512,0.00009042862,0.0042906823],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9951841,0.0031570708,0.00013879426,0.0005269631,0.00072380423,0.00026921908],"domain_scores_gemma":[0.98263377,0.013875254,0.0009986834,0.00053543324,0.0012252211,0.00073158316],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046356022,0.0007720352,0.0005146438,0.0026913288,0.0032424848,0.0028197435,0.0011661057,0.0012797499,0.001271149],"category_scores_gemma":[0.014665963,0.00028819838,0.0005622941,0.0018803369,0.0013402541,0.0030199804,0.0014668432,0.0012433123,0.0005484225],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013752782,0.0013967856,0.15933122,0.001142909,0.00026496843,0.016732298,0.55131507,0.01837376,0.0230447,0.01553156,0.016290352,0.1952012],"study_design_scores_gemma":[0.00012850168,0.0014571114,0.113974445,0.00061443844,0.0002660478,0.007235378,0.41463986,0.26867136,0.019451283,0.011395613,0.16166778,0.00049824134],"about_ca_topic_score_codex":0.011049127,"about_ca_topic_score_gemma":0.028805241,"teacher_disagreement_score":0.011049127,"about_ca_system_score_codex":0.0021361948,"about_ca_system_score_gemma":0.0009508903,"threshold_uncertainty_score":0.024515688},"labels":[],"label_agreement":null},{"id":"W4402667124","doi":"10.18653/v1/2024.acl-long.23","title":"Subtle Biases Need Subtler Measures: Dual Metrics for Evaluating Representative and Affinity Bias in Large Language Models","year":2024,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Dual (grammatical number); Natural language processing; Language model; Dual language; Artificial intelligence; Machine learning; Psychology; Linguistics","score_opus":0.4050501291309129,"score_gpt":0.5104728602784459,"score_spread":0.10542273114753298,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402667124","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4906021,0.0011643055,0.49623725,0.0007169751,0.00010138261,0.00055219344,0.0010940366,0.0016505484,0.007881207],"genre_scores_gemma":[0.92389214,0.0001270033,0.07406301,0.00014822128,0.00005900426,0.00033306546,0.00071170914,0.00024064723,0.00042513988],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9746935,0.014802435,0.0021267617,0.0025078075,0.0052812463,0.0005882061],"domain_scores_gemma":[0.81703377,0.14445096,0.011514798,0.01685111,0.007964921,0.0021844746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026615879,0.0016197352,0.00091864116,0.003948607,0.0011333158,0.0042516324,0.0009903107,0.0017944708,0.0014877327],"category_scores_gemma":[0.16395721,0.00045858126,0.0009677163,0.0028210725,0.003103638,0.005615359,0.005143665,0.002518205,0.0005392616],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022574652,0.00061627023,0.34152004,0.0018791794,0.0018374287,0.0006676696,0.015220164,0.14006598,0.024028644,0.051991556,0.0055701006,0.41434556],"study_design_scores_gemma":[0.00023908018,0.0011987853,0.077375494,0.0003810546,0.0004501187,0.0008543068,0.004269357,0.7109102,0.024663592,0.17022996,0.009109729,0.0003183733],"about_ca_topic_score_codex":0.0011699543,"about_ca_topic_score_gemma":0.0021935438,"teacher_disagreement_score":0.026615879,"about_ca_system_score_codex":0.0011268037,"about_ca_system_score_gemma":0.0011293547,"threshold_uncertainty_score":0.14075989},"labels":[],"label_agreement":null},{"id":"W4402742062","doi":"10.2139/ssrn.4935918","title":"Verifiable Content in Social Media Stock-Analysis Articles: The Long and Short of It","year":2024,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Verifiable secret sharing; Social media; Content (measure theory); Stock (firearms); Content analysis; Computer science; Psychology; Sociology; World Wide Web; Mathematics; Social science; Materials science; Metallurgy; Programming language","score_opus":0.06230855509625608,"score_gpt":0.36069227885678634,"score_spread":0.29838372376053024,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402742062","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.63401437,0.01599539,0.16778108,0.063700646,0.0064853746,0.00048206476,0.021011323,0.0019271108,0.08860263],"genre_scores_gemma":[0.9638289,0.0021358854,0.016851446,0.001778453,0.0036634451,0.00014059783,0.0034367912,0.00041792012,0.007746455],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9834351,0.0053312015,0.0014681792,0.0021339464,0.006823576,0.0008080844],"domain_scores_gemma":[0.63557076,0.28466523,0.03058472,0.026031706,0.021198047,0.001949535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014574584,0.00045323517,0.00094830367,0.0075773993,0.0020251684,0.010074724,0.0017148334,0.0037255117,0.011487707],"category_scores_gemma":[0.17536531,0.00072931324,0.0006156778,0.009055619,0.0059868502,0.018165175,0.003498471,0.0035610537,0.0025703572],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019778393,0.0004239788,0.16078892,0.0024180058,0.0006003918,0.0022641001,0.008344838,0.0064522414,0.010703428,0.41054744,0.052412115,0.3430667],"study_design_scores_gemma":[0.0001724833,0.00039408056,0.11508103,0.0022868235,0.0007470939,0.0018151656,0.0068757613,0.06172989,0.023584932,0.6775997,0.109394535,0.00031846605],"about_ca_topic_score_codex":0.002213699,"about_ca_topic_score_gemma":0.0026178802,"teacher_disagreement_score":0.014574584,"about_ca_system_score_codex":0.002301807,"about_ca_system_score_gemma":0.0023731398,"threshold_uncertainty_score":0.0770787},"labels":[],"label_agreement":null},{"id":"W4402904865","doi":"10.1167/jov.24.10.631","title":"Visualizing the Other-Race Effect with GAN-based Image Reconstruction","year":2024,"lang":"en","type":"article","venue":"Journal of Vision","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Race (biology); Computer science; Image (mathematics); Artificial intelligence; Computer vision; Geology; Paleontology","score_opus":0.016686272986576156,"score_gpt":0.4078190814550394,"score_spread":0.39113280846846327,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402904865","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.61943424,0.00052894553,0.36671206,0.00077266246,0.00019033933,0.00010479716,0.001100157,0.0015706074,0.009586159],"genre_scores_gemma":[0.94826734,0.000112802125,0.049072247,0.00016323931,0.000018316638,0.000046879548,0.0004025355,0.00014882257,0.0017678723],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99990785,0.000028177827,0.0000028081022,0.000021728458,0.000022665632,0.000016668115],"domain_scores_gemma":[0.99976605,0.00012278183,0.000023950393,0.000038484905,0.00002879199,0.000019832789],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003142884,0.00030174683,0.00014913367,0.00028248725,0.00008780717,0.00029335942,0.00026199315,0.00022313259,0.00253852],"category_scores_gemma":[0.0012902583,0.00010330712,0.00033931652,0.00012000389,0.00028039777,0.0003120465,0.00046930002,0.0006647897,0.00023127171],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010757541,0.00030845543,0.023245808,0.00044507708,0.00025597948,0.0009119112,0.001405232,0.3687589,0.33138984,0.02460378,0.012564905,0.23503447],"study_design_scores_gemma":[0.000036385143,0.0001612629,0.021433933,0.00004123394,0.000038539707,0.00045413445,0.00018908228,0.92950493,0.0319955,0.012080666,0.0040277103,0.000036598612],"about_ca_topic_score_codex":0.0012007446,"about_ca_topic_score_gemma":0.0015791511,"teacher_disagreement_score":0.00253852,"about_ca_system_score_codex":0.00022987025,"about_ca_system_score_gemma":0.00019111342,"threshold_uncertainty_score":0.008492231},"labels":[],"label_agreement":null},{"id":"W4403477213","doi":"10.1163/24523666-bja10046","title":"Educational and Career Trajectories in Russia: Introducing a New Source and Datasets with a High Granularity","year":2024,"lang":"en","type":"article","venue":"Research Data Journal for the Humanities and Social Sciences","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Granularity; Computer science; Political science; Mathematics education; Data science; Psychology; Programming language","score_opus":0.3758763393928578,"score_gpt":0.4910133060437998,"score_spread":0.11513696665094197,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403477213","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07929819,0.0007370044,0.012178963,0.0018577476,0.0005230432,0.00036681708,0.89851743,0.0014339469,0.005086931],"genre_scores_gemma":[0.085776776,0.00031881125,0.034888558,0.00024560437,0.00016216082,0.0012330946,0.87512684,0.00031313693,0.0019350373],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9973961,0.0006858176,0.00041822004,0.0007487864,0.00050238933,0.00024881202],"domain_scores_gemma":[0.9940818,0.0017110034,0.00067101174,0.0020331265,0.0011432184,0.00035993208],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021595384,0.0004477905,0.00068383955,0.0048628626,0.0010883134,0.0019897171,0.0012664855,0.0017285091,0.0040610903],"category_scores_gemma":[0.013833791,0.0004302828,0.0014153996,0.0067760865,0.0005613249,0.0013859458,0.0033232665,0.0018870619,0.0034138365],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00089044834,0.0010808811,0.32411504,0.0029529966,0.0008632217,0.0010373619,0.0038514484,0.015803633,0.005103482,0.01684429,0.5011891,0.1262681],"study_design_scores_gemma":[0.00020451013,0.00014734892,0.39675394,0.000785596,0.00019386002,0.0005128945,0.0029062703,0.011537341,0.0027502384,0.0076752435,0.5763613,0.00017144918],"about_ca_topic_score_codex":0.018824326,"about_ca_topic_score_gemma":0.0273068,"teacher_disagreement_score":0.018824326,"about_ca_system_score_codex":0.0010451842,"about_ca_system_score_gemma":0.0017762985,"threshold_uncertainty_score":0.03742951},"labels":[],"label_agreement":null},{"id":"W4403785816","doi":"10.1016/j.joi.2025.101759","title":"WISDOM: An AI-powered framework for emerging research detection using weak signal analysis and advanced topic modelling","year":2025,"lang":"en","type":"preprint","venue":"Journal of Informetrics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Defence Research and Development Canada; National Research Council Canada","funders":"","keywords":"SIGNAL (programming language); Computer science; Detection theory; Data science; Artificial intelligence; Telecommunications","score_opus":0.20340031051241791,"score_gpt":0.525670070531794,"score_spread":0.32226976001937613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403785816","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016103697,0.0004229024,0.99315816,0.0011277865,0.00013536683,0.00008179925,0.0005204907,0.0010666441,0.001876483],"genre_scores_gemma":[0.11744056,0.0009547513,0.8711008,0.00082305254,0.0009398901,0.00061523856,0.0016640284,0.00047507917,0.0059866216],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9933537,0.003223697,0.0004928424,0.0011870124,0.0014669681,0.00027581418],"domain_scores_gemma":[0.96717346,0.023361454,0.001859748,0.0036086948,0.0026765154,0.0013201896],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.013504519,0.0016580304,0.0022237147,0.009126758,0.0020407652,0.008276497,0.0033643222,0.003362417,0.007728137],"category_scores_gemma":[0.058135614,0.0008936432,0.0027694427,0.0059140595,0.0028459718,0.009846504,0.007758322,0.004420588,0.003264869],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033334483,0.00015792834,0.003933563,0.000767724,0.00037083004,0.00031419037,0.001137685,0.029269528,0.0024783204,0.6382527,0.018758995,0.30422524],"study_design_scores_gemma":[0.000034914465,0.00004003334,0.0004381434,0.000090196045,0.00006255162,0.000116948104,0.00014479694,0.23613906,0.0008144187,0.75089306,0.011185471,0.000040516366],"about_ca_topic_score_codex":0.002335398,"about_ca_topic_score_gemma":0.0033125533,"teacher_disagreement_score":0.9908732,"about_ca_system_score_codex":0.0014950709,"about_ca_system_score_gemma":0.0037450148,"threshold_uncertainty_score":0.0714196},"labels":[],"label_agreement":null},{"id":"W4404280210","doi":"10.23977/jaip.2024.070324","title":"Systemic Bias in Artificial Intelligence: Focusing on Gender, Racial, and Political Biases","year":2024,"lang":"en","type":"article","venue":"Journal of Artificial Intelligence Practice","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Politics; Gender bias; Racial bias; Psychology; Political science; Sociology; Social psychology; Artificial intelligence; Computer science; Race (biology); Gender studies; Law","score_opus":0.3386635278398094,"score_gpt":0.500945675962464,"score_spread":0.16228214812265457,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404280210","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.59823096,0.009592333,0.082177654,0.05650482,0.0010521105,0.00018742548,0.00023124497,0.000056655455,0.25196686],"genre_scores_gemma":[0.9910562,0.0008107194,0.003466726,0.0019432222,0.000246471,0.000077850025,0.000027273256,0.000026229935,0.0023453843],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9775711,0.015421884,0.00065515004,0.0016612645,0.003897603,0.00079293764],"domain_scores_gemma":[0.95373577,0.03191612,0.0068616034,0.0025444862,0.0038277302,0.001114333],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026309362,0.00037154532,0.000476373,0.002645442,0.0037454793,0.0046920306,0.00070587295,0.0010638006,0.004904861],"category_scores_gemma":[0.066711925,0.00016021534,0.00029167635,0.0024657182,0.015067214,0.007246198,0.005320458,0.0017259497,0.00034301917],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013570001,0.00008163262,0.06808274,0.00030252142,0.00007645898,0.00023758452,0.14520499,0.00040481877,0.0009349952,0.67880476,0.0039772233,0.10175663],"study_design_scores_gemma":[0.000039379982,0.00014337471,0.056015454,0.0012541021,0.0001166372,0.0006890941,0.108465,0.0023827686,0.0020754654,0.7516595,0.07708891,0.00007031733],"about_ca_topic_score_codex":0.0024500182,"about_ca_topic_score_gemma":0.0037918824,"teacher_disagreement_score":0.026309362,"about_ca_system_score_codex":0.002458889,"about_ca_system_score_gemma":0.0026076126,"threshold_uncertainty_score":0.13913882},"labels":[],"label_agreement":null},{"id":"W4404518586","doi":"10.1609/aies.v7i1.31616","title":"Understanding Intrinsic Socioeconomic Biases in Large Language Models","year":2024,"lang":"en","type":"article","venue":"Proceedings of the AAAI/ACM Conference on AI Ethics and Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; HEC Montréal","funders":"Compute Canada; Natural Sciences and Engineering Research Council of Canada; Canadian Institute for Advanced Research","keywords":"Socioeconomic status; Psychology; Sociology","score_opus":0.26075261966670643,"score_gpt":0.41649217005862593,"score_spread":0.1557395503919195,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404518586","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.51444,0.0011970302,0.46018153,0.009519605,0.0001572927,0.00012380569,0.0027183509,0.00087647024,0.010785891],"genre_scores_gemma":[0.96634966,0.00029449025,0.029496776,0.00065739837,0.00013589945,0.00010536867,0.0013426328,0.00013542542,0.0014823945],"study_design_codex":"simulation_or_modeling","study_design_gemma":"observational","domain_scores_codex":[0.99328196,0.0050458238,0.00027448832,0.0006597317,0.0005220132,0.00021593648],"domain_scores_gemma":[0.93217736,0.05940683,0.0026633833,0.003558427,0.0016986653,0.0004952708],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015884433,0.00068640755,0.0006080333,0.0012871283,0.0009222285,0.0027469688,0.0010395378,0.0010360862,0.0025694454],"category_scores_gemma":[0.08755694,0.000474462,0.0006889441,0.0010635149,0.0016767477,0.005197929,0.00315508,0.0021962025,0.00081881596],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000657131,0.0002120911,0.20678662,0.0004799169,0.0005600794,0.0008962018,0.0063031055,0.3466636,0.0027408416,0.25940835,0.015830234,0.15946183],"study_design_scores_gemma":[0.000034986035,0.000044876117,0.009197907,0.000097107375,0.00004651409,0.0001388735,0.0005318846,0.72812665,0.0010112608,0.2558071,0.004922573,0.00004020828],"about_ca_topic_score_codex":0.005398014,"about_ca_topic_score_gemma":0.009216809,"teacher_disagreement_score":0.015884433,"about_ca_system_score_codex":0.0013193872,"about_ca_system_score_gemma":0.0013580971,"threshold_uncertainty_score":0.08400589},"labels":[],"label_agreement":null},{"id":"W4404554142","doi":"10.33137/utjph.v5i1.44133","title":"Practical Implementation of Advanced Causal Inference Method: Development of an R Package for Bayesian Marginal Structural Models with Time-Varying Treatment","year":2024,"lang":"en","type":"article","venue":"University of Toronto Journal of Public Health","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto","funders":"","keywords":"Causal inference; Marginal structural model; Computer science; R package; Inference; Bayesian probability; Bayesian inference; Statistical inference; Econometrics; Machine learning; Artificial intelligence; Data mining; Statistics; Mathematics; Programming language","score_opus":0.09971528107044841,"score_gpt":0.4546119396801781,"score_spread":0.3548966586097297,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404554142","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011776766,0.00025910098,0.95798934,0.0008594556,0.00016927544,0.00044835822,0.007862521,0.029044963,0.0021892888],"genre_scores_gemma":[0.013750003,0.00030768526,0.96348464,0.0005814912,0.00009356329,0.0027788696,0.004989614,0.012261327,0.0017527449],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9894657,0.006578504,0.00074958365,0.0010338401,0.0019013053,0.0002711271],"domain_scores_gemma":[0.9445966,0.042976134,0.0030665298,0.004314729,0.004410723,0.00063528103],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02166272,0.0025728608,0.0016888526,0.0024676742,0.0006797775,0.0023508887,0.0038067917,0.0016252812,0.04154342],"category_scores_gemma":[0.10685294,0.0019208384,0.003406816,0.0021747302,0.0011078154,0.00214862,0.0030530351,0.0048109554,0.021819534],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00056642236,0.00023389311,0.011642137,0.0032632118,0.0019292708,0.0006943424,0.0010646547,0.057361264,0.0038172756,0.08635924,0.42139956,0.41166875],"study_design_scores_gemma":[0.0008980272,0.000268429,0.007840981,0.0011990865,0.0006772258,0.0010191113,0.00016330865,0.37819758,0.007835983,0.18889555,0.41258115,0.00042362575],"about_ca_topic_score_codex":0.0049726437,"about_ca_topic_score_gemma":0.0054745865,"teacher_disagreement_score":0.04154342,"about_ca_system_score_codex":0.0009887415,"about_ca_system_score_gemma":0.0050827228,"threshold_uncertainty_score":0.13897657},"labels":[],"label_agreement":null},{"id":"W4404555722","doi":"10.5539/ells.v14n4p53","title":"Digitalized Translation of Chinese Online Literature: Practice and Research","year":2024,"lang":"en","type":"article","venue":"English Language and Literature Studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Guangdong University of Foreign Studies","keywords":"China; Diversity (politics); Translation studies; Phenomenon; Translation (biology); Value (mathematics); Criticism; Computer science; Sociology; Knowledge management; Linguistics; Political science; Epistemology","score_opus":0.03899979910149484,"score_gpt":0.46735509955134336,"score_spread":0.4283553004498485,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404555722","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.659643,0.036434058,0.04096226,0.034176316,0.0022568943,0.0014015667,0.0002673338,0.00040787796,0.22445068],"genre_scores_gemma":[0.9563703,0.015639637,0.015763,0.0019925404,0.0005084722,0.0003994757,0.00015844105,0.00010043886,0.009067641],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9802798,0.012282412,0.0015876184,0.001346985,0.003776011,0.00072713196],"domain_scores_gemma":[0.946599,0.03396857,0.0031695722,0.007027083,0.007690593,0.0015451756],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024011238,0.00057136605,0.0005266869,0.008096705,0.004592684,0.00903034,0.0017587068,0.0010191819,0.0062137856],"category_scores_gemma":[0.05316774,0.0002684232,0.00055204413,0.012166009,0.008557433,0.007622039,0.0058719898,0.0014531134,0.000936091],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001276347,0.0002726124,0.018299092,0.0036718575,0.000076815944,0.0022945565,0.2128397,0.0007120773,0.002379141,0.10403323,0.009652159,0.64564115],"study_design_scores_gemma":[0.00011290238,0.00049679726,0.033361107,0.012219533,0.00022873266,0.004305125,0.41359192,0.007674225,0.00968851,0.08167165,0.43646556,0.00018384393],"about_ca_topic_score_codex":0.006286869,"about_ca_topic_score_gemma":0.00586894,"teacher_disagreement_score":0.024011238,"about_ca_system_score_codex":0.006485046,"about_ca_system_score_gemma":0.017593862,"threshold_uncertainty_score":0.12698507},"labels":[],"label_agreement":null},{"id":"W4404689554","doi":"10.1109/beliv64461.2024.00007","title":"Exploring Subjective Notions of Explainability through Counterfactual Visualization of Sentiment Analysis","year":2024,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Counterfactual thinking; Visualization; Computer science; Sentiment analysis; Data visualization; Data science; Artificial intelligence; Econometrics; Psychology; Mathematics; Social psychology","score_opus":0.17598810312883714,"score_gpt":0.43570768866380866,"score_spread":0.25971958553497154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404689554","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5049949,0.000583346,0.4599285,0.0059579676,0.00028970584,0.00090848247,0.0018570318,0.0017354266,0.023744619],"genre_scores_gemma":[0.86306983,0.0001612934,0.13369356,0.0003502767,0.00006035607,0.0007378679,0.00053463667,0.0003755205,0.0010166416],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9781861,0.017113892,0.0008450853,0.0012952279,0.0021575843,0.0004020693],"domain_scores_gemma":[0.819823,0.15657085,0.0096312575,0.007888349,0.0054220897,0.00066446577],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.034389663,0.0013327815,0.0006169745,0.0043598767,0.0019670771,0.0072588213,0.0012433882,0.0016037142,0.00493941],"category_scores_gemma":[0.12455543,0.000582277,0.0009674813,0.0021233915,0.00456813,0.007561394,0.004801525,0.0025259098,0.00050489826],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000922896,0.00017854449,0.028200788,0.0022143442,0.00023065305,0.0011087555,0.69055516,0.009120597,0.041962046,0.115807235,0.007736203,0.10196279],"study_design_scores_gemma":[0.00031903395,0.0004966916,0.046048906,0.0023353414,0.0003365784,0.0011371569,0.24542744,0.21420424,0.030366356,0.3355543,0.123131126,0.0006428586],"about_ca_topic_score_codex":0.0015165088,"about_ca_topic_score_gemma":0.002093955,"teacher_disagreement_score":0.034389663,"about_ca_system_score_codex":0.0024196324,"about_ca_system_score_gemma":0.0013532967,"threshold_uncertainty_score":0.18187207},"labels":[],"label_agreement":null},{"id":"W4404781255","doi":"10.18653/v1/2024.findings-emnlp.790","title":"Topic Modeling: Contextual Token Embeddings Are All You Need","year":2024,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Security token; Computer science; Computer security","score_opus":0.09091584989938681,"score_gpt":0.40750661388415077,"score_spread":0.31659076398476393,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404781255","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018477412,0.0027347254,0.96145284,0.0030688492,0.00064625934,0.00020748471,0.0029353471,0.0056960112,0.004781032],"genre_scores_gemma":[0.40542692,0.0040458194,0.5671899,0.0013811943,0.0011328434,0.00060921913,0.010982225,0.0019069617,0.00732488],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9979875,0.0008773176,0.00015162298,0.0004788439,0.00038590436,0.000118863005],"domain_scores_gemma":[0.9946596,0.0025316821,0.00044595188,0.0012350854,0.0009139711,0.00021366743],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002805914,0.0014731571,0.0010528187,0.0015626141,0.00059485395,0.0027368418,0.0011926368,0.0012168104,0.0055628484],"category_scores_gemma":[0.015438802,0.0005465559,0.0010042776,0.002386847,0.0006362658,0.010459468,0.0015743251,0.0025739095,0.0043160855],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080573384,0.0003953546,0.016124064,0.00097579014,0.0005662109,0.00023900568,0.0010755548,0.06933756,0.008787222,0.072943315,0.0970658,0.7316843],"study_design_scores_gemma":[0.00008343439,0.00024571517,0.0037203217,0.0003195306,0.0002771379,0.0005330833,0.0007521236,0.6911792,0.009911467,0.20990358,0.08292489,0.00014943314],"about_ca_topic_score_codex":0.0030095777,"about_ca_topic_score_gemma":0.004712314,"teacher_disagreement_score":0.0055628484,"about_ca_system_score_codex":0.0006450508,"about_ca_system_score_gemma":0.0011925885,"threshold_uncertainty_score":0.018609583},"labels":[],"label_agreement":null},{"id":"W4404783146","doi":"10.18653/v1/2024.emnlp-main.953","title":"Measuring Psychological Depth in Language Models","year":2024,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Science Foundation","keywords":"Computer science; Natural language processing; Language model; Artificial intelligence; Programming language","score_opus":0.21917950326860067,"score_gpt":0.4647030931911161,"score_spread":0.2455235899225154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404783146","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.89949256,0.0011371317,0.08454298,0.0011734781,0.000034747045,0.000071863855,0.00049396325,0.00017891324,0.012874439],"genre_scores_gemma":[0.99294335,0.00013021594,0.006384766,0.000047231435,0.00000984435,0.000024066745,0.00013651796,0.000024603893,0.00029944422],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9979538,0.0012217287,0.00005904599,0.00029769106,0.00036228844,0.000105496816],"domain_scores_gemma":[0.9785729,0.015489073,0.0015677207,0.0023451545,0.0012735169,0.00075165025],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003121931,0.00045356536,0.00032744755,0.0011505159,0.00045043256,0.0021598984,0.00045603546,0.0006694819,0.0022452413],"category_scores_gemma":[0.052643135,0.000515043,0.00044635113,0.00097556284,0.0013046229,0.0054088337,0.0024390973,0.0017203891,0.00027686864],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015448417,0.00080858625,0.4124382,0.00047779075,0.00093752786,0.00028647014,0.023185724,0.061669964,0.015905716,0.16395897,0.0076183486,0.3111679],"study_design_scores_gemma":[0.00009420211,0.0004520371,0.24534102,0.00017441309,0.00032282798,0.00046837758,0.008523208,0.3114153,0.006394714,0.41953465,0.007051178,0.00022811559],"about_ca_topic_score_codex":0.0034363645,"about_ca_topic_score_gemma":0.0030227595,"teacher_disagreement_score":0.0034363645,"about_ca_system_score_codex":0.00074845226,"about_ca_system_score_gemma":0.0003672883,"threshold_uncertainty_score":0.016510546},"labels":[],"label_agreement":null},{"id":"W4404856684","doi":"10.1177/14614456241298915","title":"Topic modelling is a means to an end: On topic modelling in corpus linguistics and discourse analysis","year":2024,"lang":"en","type":"article","venue":"Discourse Studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Corpus linguistics; Linguistics; Discourse analysis; Applied linguistics; Computer science; Quantitative linguistics; Sociology; Philosophy","score_opus":0.1362974815568709,"score_gpt":0.4772390681758816,"score_spread":0.34094158661901064,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404856684","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048321094,0.08342887,0.70969564,0.18383779,0.0040220297,0.00018596834,0.00022762663,0.0003450912,0.01342487],"genre_scores_gemma":[0.23755889,0.10178866,0.56445354,0.05417518,0.02622922,0.002291182,0.00081349653,0.0024849016,0.010204861],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92809665,0.06096201,0.0018656069,0.0034962168,0.0048627155,0.00071680296],"domain_scores_gemma":[0.7402308,0.24136345,0.003503849,0.0078040464,0.005705676,0.0013922411],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06727152,0.0019115792,0.0027668497,0.0084615145,0.005506949,0.020842822,0.005185736,0.010081132,0.005414136],"category_scores_gemma":[0.13462286,0.0016391932,0.002039607,0.013412919,0.02838922,0.03857501,0.014740152,0.01770976,0.0026294922],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006783244,0.000038678525,0.00083070784,0.0006825557,0.00009301068,0.00020200509,0.020155039,0.00417694,0.0002272086,0.9048171,0.017921392,0.050787494],"study_design_scores_gemma":[0.00001892589,0.000023641756,0.0003575637,0.0015693841,0.000032103057,0.00017533684,0.00267329,0.0133013055,0.0002953522,0.8850594,0.096388645,0.00010502142],"about_ca_topic_score_codex":0.0064579155,"about_ca_topic_score_gemma":0.005460497,"teacher_disagreement_score":0.93272847,"about_ca_system_score_codex":0.006969984,"about_ca_system_score_gemma":0.0041975435,"threshold_uncertainty_score":0.35577005},"labels":[],"label_agreement":null},{"id":"W4405113218","doi":"10.1016/j.procs.2024.11.126","title":"NLP and Topic Modeling with LDA, LSA, and NMF for Monitoring Psychosocial Well-being in Monthly Surveys","year":2024,"lang":"en","type":"article","venue":"Procedia Computer Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Rimouski","funders":"","keywords":"Computer science; Natural language processing; Artificial intelligence; Information retrieval; Topic model; Data science","score_opus":0.028954047006875528,"score_gpt":0.35239906247632974,"score_spread":0.3234450154694542,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405113218","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12565571,0.0014451178,0.8668575,0.0010314212,0.00016497413,0.00062149594,0.0021020574,0.0013534065,0.00076823664],"genre_scores_gemma":[0.44988605,0.00057671417,0.54114604,0.00019523352,0.0002863148,0.0021115334,0.0050214813,0.00013020335,0.0006463763],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9883173,0.008990856,0.0006579487,0.0012321202,0.000577839,0.00022382195],"domain_scores_gemma":[0.960045,0.036212638,0.0013422569,0.0011085111,0.001081015,0.00021064792],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013897268,0.0013545338,0.0013125639,0.005271356,0.0012007275,0.0018940325,0.00100086,0.0013314049,0.000962235],"category_scores_gemma":[0.032518443,0.0005128332,0.0026718685,0.0034053137,0.0007182594,0.0020436514,0.0015324544,0.002246884,0.00052276516],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009807694,0.0011735429,0.073660165,0.0011509581,0.0018288469,0.00050014514,0.0039017166,0.2295715,0.006686063,0.011516504,0.009085811,0.659944],"study_design_scores_gemma":[0.00004543816,0.00010263699,0.009152922,0.000059712245,0.00008475675,0.0000740245,0.00061716564,0.9733262,0.0009438326,0.013452661,0.0020843798,0.00005627766],"about_ca_topic_score_codex":0.008226607,"about_ca_topic_score_gemma":0.008845959,"teacher_disagreement_score":0.013897268,"about_ca_system_score_codex":0.0010015287,"about_ca_system_score_gemma":0.001567214,"threshold_uncertainty_score":0.07349664},"labels":[],"label_agreement":null},{"id":"W4405356570","doi":"10.5539/ijel.v15n1p71","title":"An Introduction to Quantitative Text Analysis for Linguistics: Reproducible Research Using R","year":2024,"lang":"en","type":"article","venue":"International Journal of English Linguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Linguistics; Applied linguistics; Quantitative analysis (chemistry); Natural language processing; Chemistry; Philosophy; Chromatography","score_opus":0.1673412948728796,"score_gpt":0.5322337886602312,"score_spread":0.36489249378735156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405356570","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013751586,0.052061178,0.6707836,0.052024797,0.017075865,0.0015273674,0.014938462,0.020533618,0.16967997],"genre_scores_gemma":[0.013323048,0.05780574,0.6842819,0.020073865,0.01222523,0.005093938,0.012932874,0.026284527,0.16797894],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9873067,0.0052885003,0.00086569303,0.0014931225,0.0048382017,0.00020780656],"domain_scores_gemma":[0.9307641,0.055032186,0.0020862045,0.0038712786,0.0074312803,0.0008149998],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.011720588,0.0016998315,0.0019167545,0.0037082655,0.0015400903,0.007484136,0.0024316171,0.002580125,0.06445571],"category_scores_gemma":[0.058642574,0.001629266,0.0017027889,0.005481627,0.003278469,0.0058945073,0.002841742,0.0070061437,0.055572297],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000037770627,0.000038232552,0.00027512806,0.0018683441,0.000068937035,0.00014855605,0.0011370549,0.0008549988,0.0008866708,0.061134934,0.7370025,0.19654685],"study_design_scores_gemma":[0.000010797619,0.000029187344,0.00048124345,0.000961409,0.000014755949,0.00023637206,0.00022315365,0.00083643885,0.00040950696,0.04360657,0.9531399,0.000050720413],"about_ca_topic_score_codex":0.0015243632,"about_ca_topic_score_gemma":0.0021233794,"teacher_disagreement_score":0.9882794,"about_ca_system_score_codex":0.0018448866,"about_ca_system_score_gemma":0.0043890597,"threshold_uncertainty_score":0.21562588},"labels":[],"label_agreement":null},{"id":"W4405419073","doi":"10.1017/s1049096524000714","title":"Achieving Transparency, Traceability, and Readability with Human-Coded Data","year":2024,"lang":"en","type":"article","venue":"PS Political Science & Politics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"University of Melbourne; Deutsche Forschungsgemeinschaft","keywords":"Readability; Traceability; Transparency (behavior); Political science; Computer science; Data science; Accounting; Business; Computer security; Software engineering; Programming language","score_opus":0.13410126515428522,"score_gpt":0.47217432851632657,"score_spread":0.33807306336204135,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405419073","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08811466,0.0021303585,0.82276624,0.035302557,0.0016191046,0.0046482207,0.00826998,0.0008591532,0.03628968],"genre_scores_gemma":[0.38454142,0.0014391531,0.58848715,0.0043881014,0.0005323859,0.010597318,0.004698255,0.001048116,0.004268152],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.52311766,0.38147542,0.03193747,0.01724874,0.04329472,0.0029259399],"domain_scores_gemma":[0.118822895,0.58697724,0.048141025,0.17108455,0.07343556,0.0015387427],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3612924,0.001224414,0.0014505596,0.016708855,0.0076780794,0.022402747,0.004873345,0.0031151741,0.008243069],"category_scores_gemma":[0.7115324,0.0013737084,0.0016544777,0.01589975,0.025040848,0.022707626,0.017656252,0.00595178,0.001740272],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005362376,0.00027301602,0.029084114,0.0066358526,0.00035374254,0.000556818,0.24907161,0.004053813,0.008109991,0.3992737,0.025674634,0.27637637],"study_design_scores_gemma":[0.0001783144,0.00021290254,0.016402805,0.017048575,0.00022189764,0.0004453821,0.07147813,0.010009755,0.021996517,0.5986569,0.26283166,0.0005172315],"about_ca_topic_score_codex":0.006255219,"about_ca_topic_score_gemma":0.0075734053,"teacher_disagreement_score":0.63870764,"about_ca_system_score_codex":0.010599563,"about_ca_system_score_gemma":0.024335237,"threshold_uncertainty_score":0.7876402},"labels":[],"label_agreement":null},{"id":"W4405427511","doi":"10.1145/3698587.3701368","title":"MixEHR-Nest: Identifying Subphenotypes within Electronic Health Records through Hierarchical Guided-Topic Modeling","year":2024,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"Universitas Brawijaya","keywords":"Health records; Computer science; Data science; Electronic health record; Multilevel model; Machine learning; Health care; Political science","score_opus":0.11400986131973224,"score_gpt":0.4467655029363127,"score_spread":0.33275564161658044,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405427511","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.098615766,0.0025051008,0.86838466,0.0020022953,0.00012321955,0.000573262,0.018156368,0.007984678,0.0016546671],"genre_scores_gemma":[0.4961924,0.0011376682,0.4410724,0.0012494687,0.00041606135,0.001493188,0.053330265,0.000800271,0.0043083094],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9977939,0.0010694208,0.0001455988,0.00065057713,0.00021915893,0.000121302946],"domain_scores_gemma":[0.99284995,0.005648438,0.00042538764,0.0005891488,0.00032070803,0.00016632196],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003826735,0.001081057,0.00097544433,0.0034170747,0.00064242247,0.0011881334,0.0016383103,0.0011569302,0.0021001727],"category_scores_gemma":[0.010124431,0.0005098571,0.0025365888,0.0021265422,0.00054465723,0.0015733397,0.0020564084,0.0014890622,0.0012917713],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016011043,0.00082314183,0.14975226,0.0018941192,0.0022620938,0.0012033153,0.0044074124,0.142936,0.0143333245,0.02736261,0.07558143,0.57784325],"study_design_scores_gemma":[0.00021345075,0.00017609511,0.014622906,0.00013407704,0.00035498143,0.0004479057,0.00042168458,0.91396266,0.0031299947,0.05088013,0.015579434,0.00007677832],"about_ca_topic_score_codex":0.007850855,"about_ca_topic_score_gemma":0.023865119,"teacher_disagreement_score":0.007850855,"about_ca_system_score_codex":0.0006939033,"about_ca_system_score_gemma":0.0014916642,"threshold_uncertainty_score":0.020237982},"labels":[],"label_agreement":null},{"id":"W4405750169","doi":"10.1016/j.jval.2024.10.2428","title":"MSR194 Qualitative Literature Reviews: A Comparison of Researcher and AI Screening of Articles to Inform Conceptual Model Development","year":2024,"lang":"en","type":"article","venue":"Value in Health","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Data science; Computer science; Management science; Psychology; Engineering","score_opus":0.4634870499803747,"score_gpt":0.5872027738509282,"score_spread":0.12371572387055352,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405750169","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5975864,0.0517294,0.109011784,0.020586599,0.0014669222,0.087406315,0.044504832,0.0019079132,0.085799836],"genre_scores_gemma":[0.6737139,0.014346009,0.20408282,0.004305426,0.00029012334,0.08906586,0.0072084544,0.0005284287,0.0064590164],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.77732617,0.14956231,0.036538202,0.005244312,0.028484082,0.0028449718],"domain_scores_gemma":[0.41134295,0.45586804,0.04274904,0.011438046,0.07598879,0.0026131338],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17040567,0.0008090074,0.0029303643,0.035573382,0.004217284,0.0077903974,0.0032836916,0.0020200047,0.0141418995],"category_scores_gemma":[0.4602833,0.0012901826,0.0042795064,0.027820414,0.0024250676,0.00654272,0.008388263,0.0012507668,0.0017218769],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006874158,0.00051459146,0.043938383,0.19545121,0.0037450786,0.00080421637,0.24866334,0.0007234652,0.008521785,0.016186966,0.02045571,0.4541211],"study_design_scores_gemma":[0.0057118568,0.0039667794,0.15886515,0.21293661,0.018549522,0.0018652258,0.3201994,0.0053014928,0.017035084,0.026075866,0.22838427,0.0011086899],"about_ca_topic_score_codex":0.009746279,"about_ca_topic_score_gemma":0.026582366,"teacher_disagreement_score":0.8295943,"about_ca_system_score_codex":0.013294257,"about_ca_system_score_gemma":0.03668961,"threshold_uncertainty_score":0.9012021},"labels":[],"label_agreement":null},{"id":"W4405751011","doi":"10.1016/j.jval.2024.10.3836","title":"PT5 Structural Uncertainty in Evidence Synthesis: A Case Study Applying Model Averaging in Bayesian Multi-Level Network Meta-Regression","year":2024,"lang":"en","type":"article","venue":"Value in Health","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"MD Precision (Canada)","funders":"","keywords":"Bayesian network; Meta-regression; Bayesian probability; Computer science; Econometrics; Regression; Bayesian inference; Meta-analysis; Statistics; Machine learning; Artificial intelligence; Mathematics; Medicine; Internal medicine","score_opus":0.3870796255532057,"score_gpt":0.48490395925628127,"score_spread":0.09782433370307558,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405751011","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04258707,0.012091568,0.9267013,0.008605306,0.00033396206,0.0015835719,0.0010929481,0.0005575164,0.006446715],"genre_scores_gemma":[0.5604987,0.0029877287,0.43180344,0.0013673268,0.00022059592,0.0013592419,0.00051458087,0.00027002598,0.0009782963],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.70468783,0.2764625,0.006784061,0.0054141334,0.0059812916,0.0006703403],"domain_scores_gemma":[0.24417189,0.7316893,0.0074388315,0.010237161,0.005834831,0.00062799716],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17936623,0.0014881111,0.0029507522,0.0035389792,0.0016214696,0.0050262003,0.003112791,0.0041968776,0.007056508],"category_scores_gemma":[0.52141255,0.0010740719,0.006985894,0.0043527246,0.0019083885,0.0047225608,0.003546015,0.0051480397,0.00047566657],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0046246247,0.00043741247,0.018524893,0.017201098,0.03581707,0.0015504344,0.0029044996,0.28259945,0.0014427848,0.13569574,0.007802135,0.49139977],"study_design_scores_gemma":[0.0009242909,0.0010887859,0.003835942,0.00530945,0.023190098,0.0009076392,0.00059712096,0.61036444,0.0030520952,0.33597907,0.014526416,0.00022467779],"about_ca_topic_score_codex":0.008550756,"about_ca_topic_score_gemma":0.009644573,"teacher_disagreement_score":0.82063377,"about_ca_system_score_codex":0.0046520755,"about_ca_system_score_gemma":0.007732303,"threshold_uncertainty_score":0.94859064},"labels":[],"label_agreement":null},{"id":"W4406139743","doi":"10.7302/25077","title":"Three Papers in the Applied Use of Machine Learning and Artificial Intelligence Models for the Analysis of Political Text Data","year":2024,"lang":"en","type":"article","venue":"Deep Blue (University of Michigan)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Artificial intelligence; Computer science; Politics; Data science; Natural language processing; Political science","score_opus":0.10897304560184927,"score_gpt":0.3307422178810012,"score_spread":0.22176917227915194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406139743","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016533464,0.061304018,0.7585232,0.10067276,0.020986047,0.00061947206,0.000925004,0.0014739495,0.03896199],"genre_scores_gemma":[0.15776606,0.0757958,0.6307997,0.043256067,0.028911844,0.0021822231,0.0021444834,0.001666345,0.057477396],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98525256,0.005817032,0.0012416871,0.0032245177,0.003909406,0.00055478484],"domain_scores_gemma":[0.9345896,0.045025855,0.002012923,0.007825923,0.009038264,0.0015074766],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026172372,0.001876833,0.0014188234,0.0076429797,0.0026577068,0.01178771,0.0028971885,0.0063597183,0.005507775],"category_scores_gemma":[0.055872973,0.0014399834,0.003280299,0.012673598,0.00601541,0.00748488,0.007272001,0.010208645,0.0033490816],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028967267,0.00078326644,0.013463032,0.0019962115,0.00068157434,0.00053398137,0.002831688,0.0076046097,0.0044182995,0.336391,0.09911695,0.5318898],"study_design_scores_gemma":[0.00012718742,0.00024663992,0.0045918133,0.0018561063,0.00026970374,0.0009642245,0.0015747539,0.035423316,0.011633997,0.16387406,0.7792257,0.00021254555],"about_ca_topic_score_codex":0.0017128331,"about_ca_topic_score_gemma":0.002120072,"teacher_disagreement_score":0.026172372,"about_ca_system_score_codex":0.0039534974,"about_ca_system_score_gemma":0.0037869057,"threshold_uncertainty_score":0.13841438},"labels":[],"label_agreement":null},{"id":"W4406319232","doi":"10.20944/preprints202501.0942.v1","title":"Using Topic Modeling as a Semantic Technology: Examining Research Article Claims to Identify the Role of Non-Human Actants in the Pursuit of Scientific Inventions","year":2025,"lang":"en","type":"preprint","venue":"Preprints.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Epistemology; Engineering ethics; Knowledge management; Data science; Sociology; Management science; Psychology; Computer science; Engineering; Philosophy","score_opus":0.5189982465899602,"score_gpt":0.5847913523868156,"score_spread":0.06579310579685538,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406319232","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.49160245,0.006568343,0.4301948,0.015695756,0.0004444651,0.000687145,0.001740446,0.00031491937,0.052751616],"genre_scores_gemma":[0.93497795,0.0018839694,0.058862984,0.00040692362,0.00031098054,0.00056656316,0.0009582777,0.000119520155,0.0019127966],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.98312575,0.010928833,0.0011001284,0.0021236776,0.0023033163,0.00041831416],"domain_scores_gemma":[0.80635566,0.17204504,0.011503547,0.0050703418,0.0040478953,0.0009774985],"candidate_categories":["bibliometrics","sts"],"consensus_categories":[],"category_scores_codex":[0.023554029,0.0007934357,0.0008291289,0.013301696,0.0026797084,0.008949214,0.001114907,0.0019773215,0.0024377783],"category_scores_gemma":[0.08626107,0.00039575773,0.0010839733,0.014574571,0.0055967835,0.014531516,0.0033236218,0.0020897356,0.0005080139],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045126415,0.00025171187,0.066446625,0.0019503157,0.0003327391,0.0011801329,0.15604538,0.00695501,0.0045255665,0.579791,0.0057279603,0.17634222],"study_design_scores_gemma":[0.00008703302,0.00019212023,0.04564543,0.0017036282,0.00045249492,0.0014765695,0.10108633,0.13556524,0.0066574733,0.61642784,0.09054567,0.00016021734],"about_ca_topic_score_codex":0.0017521306,"about_ca_topic_score_gemma":0.0018123776,"teacher_disagreement_score":0.9973203,"about_ca_system_score_codex":0.0038903705,"about_ca_system_score_gemma":0.002217915,"threshold_uncertainty_score":0.12456709},"labels":[],"label_agreement":null},{"id":"W4407330655","doi":"10.2139/ssrn.5128896","title":"Enhancing ESG News Annotation: Leveraging GPT for the Analysis of ESG News and Events","year":2025,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Business; News analytics; Annotation; News media; Advertising; Computer science; Finance","score_opus":0.03073698495373214,"score_gpt":0.3755013808204492,"score_spread":0.3447643958667171,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407330655","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.065602764,0.001753706,0.7802666,0.0032558125,0.0018526237,0.0009936454,0.05812063,0.062937625,0.025216553],"genre_scores_gemma":[0.19526467,0.0012177461,0.7029694,0.00067108695,0.0011735859,0.00062274607,0.079258986,0.004572095,0.014249763],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99766433,0.000673127,0.00018604685,0.00073315663,0.0005866629,0.00015676237],"domain_scores_gemma":[0.99196726,0.003936099,0.00044661196,0.0015575716,0.0018279804,0.00026449075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002513404,0.001565127,0.00086852326,0.009504656,0.0012920155,0.003843179,0.0011423957,0.0019779596,0.0079440875],"category_scores_gemma":[0.017843038,0.0005556224,0.0014095944,0.0072616395,0.0005477559,0.0040264344,0.0032265163,0.0022816556,0.012244931],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005954438,0.000444056,0.016400693,0.0014374248,0.0003247635,0.0012162012,0.0021812725,0.008114169,0.037940226,0.007049061,0.12433732,0.7999594],"study_design_scores_gemma":[0.00014893698,0.00023815023,0.037233647,0.00036468566,0.00061709236,0.0012379633,0.0027085573,0.5617343,0.050787024,0.06121208,0.28347012,0.00024745386],"about_ca_topic_score_codex":0.008491998,"about_ca_topic_score_gemma":0.012931192,"teacher_disagreement_score":0.009504656,"about_ca_system_score_codex":0.000664233,"about_ca_system_score_gemma":0.001697897,"threshold_uncertainty_score":0.026575565},"labels":[],"label_agreement":null},{"id":"W4407382854","doi":"10.1007/978-3-031-72072-7_34","title":"Lecturing “In Theory, It is a Good Idea: On the Lecturing of Abstract IR Theory to ‘Generation Text’”","year":2024,"lang":"en","type":"book-chapter","venue":"Political pedagogies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Mathematics education; Psychology; Multimedia","score_opus":0.13859816235531822,"score_gpt":0.4245872814209577,"score_spread":0.2859891190656395,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407382854","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010898689,0.0039749634,0.14822061,0.05697186,0.004768421,0.00009891447,0.00021906388,0.0010333107,0.77381414],"genre_scores_gemma":[0.3700676,0.0035888369,0.06530196,0.016445534,0.0036700654,0.0003732097,0.0006108393,0.0018785796,0.53806335],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9965603,0.0024847684,0.000066537585,0.00025303505,0.0004831251,0.00015219308],"domain_scores_gemma":[0.9877473,0.009304972,0.00029759583,0.0012918446,0.00084869715,0.00050957926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0044918675,0.00056008797,0.0003896644,0.0012690792,0.002716786,0.0068737576,0.0014418638,0.0015149603,0.038883515],"category_scores_gemma":[0.020329248,0.00020886457,0.00048906606,0.001218978,0.012842881,0.01003297,0.0027323475,0.0048219357,0.010027113],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00001594202,0.000030250618,0.00026065193,0.000080901904,0.0000035888272,0.000056729317,0.0049318746,0.00014724447,0.00021445325,0.8544245,0.06516599,0.07466786],"study_design_scores_gemma":[0.000013775292,0.000032654425,0.00038978658,0.00021708985,0.0000032925618,0.000117190524,0.0024042963,0.0010297095,0.0007751174,0.78447694,0.21052545,0.000014760011],"about_ca_topic_score_codex":0.00092445733,"about_ca_topic_score_gemma":0.0011800274,"teacher_disagreement_score":0.038883515,"about_ca_system_score_codex":0.0020870962,"about_ca_system_score_gemma":0.0019390318,"threshold_uncertainty_score":0.13007832},"labels":[],"label_agreement":null},{"id":"W4407753658","doi":"10.3233/shti250003","title":"Mining Public Voices: Analyzing Suicide-Related Thoughts and Behaviors in YouTube Videos and Comments Using Topic Modeling","year":2025,"lang":"en","type":"article","venue":"Studies in health technology and informatics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Centre for Addiction and Mental Health","funders":"","keywords":"Social media; Internet privacy; Public opinion; Perception; Computer science; World Wide Web; Promotion (chess); Focus (optics); Data science; Focus group; Psychology; Sociology; Political science","score_opus":0.13978313065827183,"score_gpt":0.47543156306160356,"score_spread":0.33564843240333175,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407753658","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9574965,0.0010305647,0.023505557,0.0012923587,0.00014524513,0.0006152251,0.010830142,0.00039099655,0.004693395],"genre_scores_gemma":[0.9593467,0.0005371194,0.024563968,0.00011403152,0.00013365931,0.0006944607,0.012579215,0.0000505355,0.001980288],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998425,0.0006901645,0.0001690147,0.00028029675,0.00028685597,0.00014869594],"domain_scores_gemma":[0.99248004,0.0054302304,0.0008467263,0.0002838307,0.0007821552,0.00017699719],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00231396,0.0006694883,0.00038136443,0.0052255862,0.0007987634,0.0014496876,0.00046736415,0.0006615635,0.0010230566],"category_scores_gemma":[0.010086362,0.00015530293,0.0006514194,0.0031195425,0.00038603286,0.0017979497,0.00097368704,0.00053936907,0.0006724153],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00075277605,0.0007302665,0.5164598,0.0016289623,0.0003281383,0.0017783281,0.044054355,0.007950726,0.012477831,0.0042149117,0.021846421,0.38777748],"study_design_scores_gemma":[0.00007251811,0.00048262192,0.48877338,0.00073140743,0.00030889243,0.0010896432,0.13121021,0.30846435,0.009298225,0.008137188,0.051243573,0.00018806124],"about_ca_topic_score_codex":0.013058514,"about_ca_topic_score_gemma":0.017158743,"teacher_disagreement_score":0.013058514,"about_ca_system_score_codex":0.0008054821,"about_ca_system_score_gemma":0.0007249995,"threshold_uncertainty_score":0.025965035},"labels":[],"label_agreement":null},{"id":"W4407830444","doi":"10.1371/journal.pone.0318421","title":"Behind the mask: Random and selective masking in transformer models applied to specialized social science texts","year":2025,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Masking (illustration); Computer science; Transformer; Classifier (UML); Artificial intelligence; Random forest; Coronavirus disease 2019 (COVID-19); Machine learning; Natural language processing; Speech recognition; Pattern recognition (psychology); Engineering; Medicine","score_opus":0.057808984290345644,"score_gpt":0.33667059085330475,"score_spread":0.2788616065629591,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407830444","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5012184,0.001360856,0.48149413,0.002465587,0.00027943356,0.0005467945,0.0011209607,0.0047909026,0.0067229145],"genre_scores_gemma":[0.9064509,0.00022641344,0.088644445,0.0004437066,0.0000957516,0.00019588618,0.0011443831,0.00022892833,0.002569491],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9979971,0.0011825127,0.000120494195,0.00033529522,0.00024297174,0.000121612975],"domain_scores_gemma":[0.98807436,0.009253356,0.0006132726,0.0012590919,0.0005759048,0.00022405351],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0078088585,0.0012214018,0.00085903436,0.0012776034,0.0008010314,0.0017886695,0.0013882793,0.0013767213,0.003481879],"category_scores_gemma":[0.026762482,0.0005347074,0.0012731465,0.0006367933,0.0010215339,0.0038540564,0.0017373635,0.0023869595,0.0020468563],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005312745,0.0008551054,0.04387574,0.0007812227,0.0006115512,0.0006243908,0.0026607602,0.29934192,0.026758412,0.046238955,0.015913205,0.5570259],"study_design_scores_gemma":[0.000073003706,0.00030234014,0.0022098583,0.00005446315,0.00007243255,0.00012226054,0.00016443012,0.9616515,0.006985702,0.026425863,0.0018985185,0.000039643874],"about_ca_topic_score_codex":0.0032130447,"about_ca_topic_score_gemma":0.005318031,"teacher_disagreement_score":0.0078088585,"about_ca_system_score_codex":0.000946199,"about_ca_system_score_gemma":0.0011188549,"threshold_uncertainty_score":0.041297734},"labels":[],"label_agreement":null},{"id":"W4408118927","doi":"10.1080/10410236.2025.2469933","title":"Examining Social Support Conversations on Reddit During COVID-19 Using Computational Methods","year":2025,"lang":"en","type":"article","venue":"Health Communication","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Social media; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Computer science; Pandemic; Health communication; Psychology; World Wide Web; Biology; Communication; Medicine; Virology","score_opus":0.27567453208823617,"score_gpt":0.5616208196903251,"score_spread":0.2859462876020889,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408118927","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9784979,0.00018603879,0.011402644,0.0008596819,0.000053301414,0.00033114056,0.0057030595,0.00024518018,0.002721023],"genre_scores_gemma":[0.9629752,0.00015935417,0.025505146,0.00015474226,0.00008107601,0.0012395014,0.008143953,0.000060979917,0.0016800372],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99576193,0.0029836937,0.00023097153,0.0004807281,0.00033334934,0.00020940558],"domain_scores_gemma":[0.9283903,0.06587025,0.003106398,0.0009555681,0.001190053,0.0004873945],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055375537,0.00057066994,0.0004281417,0.0037742907,0.0012694431,0.0024084763,0.00091644994,0.0010174967,0.003033304],"category_scores_gemma":[0.03020742,0.00029107963,0.00085257436,0.0038022266,0.00067423034,0.0021073993,0.0018413757,0.0012681355,0.0009160278],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017955245,0.002057164,0.5736278,0.0027696018,0.0006361102,0.0011336218,0.11522435,0.036737755,0.007364799,0.013108644,0.017395468,0.22814906],"study_design_scores_gemma":[0.00015142474,0.00047949472,0.39142948,0.00051689043,0.00025691852,0.0003579163,0.07192495,0.49564803,0.0042793914,0.010785255,0.02394912,0.00022120531],"about_ca_topic_score_codex":0.011686856,"about_ca_topic_score_gemma":0.018038603,"teacher_disagreement_score":0.011686856,"about_ca_system_score_codex":0.0016979616,"about_ca_system_score_gemma":0.0013901184,"threshold_uncertainty_score":0.029285729},"labels":[],"label_agreement":null},{"id":"W4408213199","doi":"10.35609/gcbssproceeding.2024.1(6)","title":"The Regeneration of the Dramatic Gene in Contemporary Cinema: Based on Linda Hutcheon's Dual Interpretation of Adaptation from Cultural and Biological Perspectives","year":2024,"lang":"en","type":"article","venue":"Global Conference on Business and Social Sciences Proceeding","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Regeneration (biology); Adaptation (eye); Interpretation (philosophy); Dual (grammatical number); Movie theater; Environmental ethics; Art; Cognitive science; Biology; History; Art history; Neuroscience; Literature; Cell biology; Philosophy; Psychology; Linguistics","score_opus":0.17340592041976705,"score_gpt":0.39456246307740234,"score_spread":0.2211565426576353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408213199","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19269437,0.023668759,0.024461675,0.07113856,0.0022123808,0.000120147066,0.000101323734,0.00016167201,0.68544114],"genre_scores_gemma":[0.97435457,0.0032498217,0.0027936,0.0034705317,0.0004520583,0.00007292345,0.000021812974,0.00007000284,0.015514717],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9986125,0.0009196249,0.000019773854,0.00016965257,0.0001722143,0.000106119405],"domain_scores_gemma":[0.9986707,0.0008565077,0.00012524438,0.00009921185,0.00011086316,0.00013756375],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013960267,0.0003877113,0.00026286763,0.0013974826,0.0048916265,0.0067914855,0.0011003657,0.0016787403,0.0023722167],"category_scores_gemma":[0.0030959991,0.00016509442,0.00021675247,0.0006784396,0.041482538,0.0069467295,0.0043927245,0.003087422,0.0002644962],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000038139013,0.000021797125,0.0010343109,0.0001152695,0.0000056921203,0.0005689534,0.22648129,0.00013362714,0.00079748366,0.75297296,0.0055198157,0.01231072],"study_design_scores_gemma":[0.000028948327,0.00008668358,0.004701516,0.00076227414,0.000028480343,0.0025610537,0.16911386,0.0012339242,0.0014154541,0.25615877,0.5638356,0.00007348746],"about_ca_topic_score_codex":0.0051005394,"about_ca_topic_score_gemma":0.0071757436,"teacher_disagreement_score":0.0067914855,"about_ca_system_score_codex":0.003345275,"about_ca_system_score_gemma":0.0012812633,"threshold_uncertainty_score":0.024271846},"labels":[],"label_agreement":null},{"id":"W4408527319","doi":"10.3390/app15063253","title":"Using Topic Modeling as a Semantic Technology: Examining Research Article Claims to Identify the Role of Non-Human Actants in the Pursuit of Scientific Inventions","year":2025,"lang":"en","type":"article","venue":"Applied Sciences","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Carleton University","funders":"","keywords":"Engineering ethics; Knowledge management; Epistemology; Sociology; Data science; Management science; Computer science; Engineering; Philosophy","score_opus":0.2594868480807244,"score_gpt":0.5458822664470235,"score_spread":0.2863954183662991,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408527319","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.52307016,0.008362483,0.3734356,0.020351969,0.00064999657,0.0010831108,0.0012055321,0.0002851209,0.07155608],"genre_scores_gemma":[0.93183595,0.0030898831,0.05966683,0.00058273016,0.00029122495,0.00085486047,0.0007458736,0.00013148638,0.002801169],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.979127,0.014673274,0.0012047446,0.0020007445,0.0025519745,0.00044213986],"domain_scores_gemma":[0.8102292,0.17108102,0.009338112,0.0045360876,0.003922717,0.0008929106],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.025524976,0.0008773759,0.00076184724,0.013782091,0.0038566932,0.010294484,0.0014119094,0.0020409487,0.0020735296],"category_scores_gemma":[0.06809511,0.0004277717,0.0009562911,0.013623252,0.008209161,0.01606249,0.0039483183,0.0023730814,0.0004287748],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019491768,0.000119202625,0.0256346,0.0018345352,0.00011386169,0.0011741776,0.5230703,0.0021365008,0.0036428827,0.34165648,0.0034527753,0.09696983],"study_design_scores_gemma":[0.00006178256,0.00015006955,0.023651987,0.0026680573,0.0002548267,0.0017942751,0.4633094,0.045020305,0.006829458,0.2937666,0.16235709,0.00013613394],"about_ca_topic_score_codex":0.0017642488,"about_ca_topic_score_gemma":0.0019612154,"teacher_disagreement_score":0.9961433,"about_ca_system_score_codex":0.004853655,"about_ca_system_score_gemma":0.002963137,"threshold_uncertainty_score":0.13499057},"labels":[],"label_agreement":null},{"id":"W4408567157","doi":"10.61091/jcmcc124-25","title":"Research on thematic clustering and text mining of chinese modern and contemporary literary texts in the network era","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Thematic map; Cluster analysis; Literature; History; Information retrieval; Linguistics; Data science; Computer science; Artificial intelligence; Art; Geography; Philosophy; Cartography","score_opus":0.05007256040533145,"score_gpt":0.3883092477054205,"score_spread":0.33823668730008905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408567157","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.62135226,0.010499711,0.3330012,0.0028314192,0.0003939766,0.00040179942,0.0011840395,0.0005571725,0.029778505],"genre_scores_gemma":[0.8518191,0.0059701405,0.1338707,0.00016925552,0.0003166506,0.0002916861,0.0011644416,0.00008870838,0.0063094003],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990933,0.0002326273,0.000086778375,0.00022936612,0.00028867315,0.00006914684],"domain_scores_gemma":[0.9976926,0.0010231696,0.00029228075,0.00018830235,0.0007175333,0.00008619318],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016157359,0.0004594099,0.0004093054,0.0072652944,0.0018407702,0.0019293809,0.00068920484,0.00036533165,0.0011191943],"category_scores_gemma":[0.0052927868,0.00018423461,0.0006464257,0.008638603,0.00092898746,0.0043672416,0.00073735556,0.0004890584,0.00025608847],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022879361,0.00013864679,0.0574815,0.0028006074,0.00029495262,0.0009176574,0.02227637,0.016637607,0.019666268,0.075617485,0.0072769527,0.7966632],"study_design_scores_gemma":[0.000051591174,0.00038363354,0.18961655,0.0010545733,0.0008497519,0.0023591514,0.044210963,0.43043813,0.05334006,0.1369878,0.14047055,0.00023730696],"about_ca_topic_score_codex":0.004220459,"about_ca_topic_score_gemma":0.0051343623,"teacher_disagreement_score":0.0072652944,"about_ca_system_score_codex":0.0012666024,"about_ca_system_score_gemma":0.0016554608,"threshold_uncertainty_score":0.009189844},"labels":[],"label_agreement":null},{"id":"W4408567674","doi":"10.61091/jcmcc124-28","title":"Exploring the social and cultural contexts in ancient chinese literature using natural language processing techniques","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Natural (archaeology); Linguistics; History; Sociology; Archaeology; Philosophy","score_opus":0.036382338127129786,"score_gpt":0.3781597734527998,"score_spread":0.34177743532567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408567674","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9213081,0.0030910526,0.048957955,0.0014607351,0.00010627606,0.00029322752,0.0040357932,0.00045553627,0.020291239],"genre_scores_gemma":[0.9519471,0.00143978,0.040530037,0.00012931484,0.000079739104,0.00013684994,0.0022595588,0.000029670933,0.0034480507],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99975187,0.00006379114,0.00003126889,0.00007446938,0.00005059204,0.000027978907],"domain_scores_gemma":[0.9995096,0.00026145484,0.00009811703,0.000030306002,0.00008018411,0.00002043189],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00037114602,0.00036553477,0.00015559288,0.0052564796,0.00085618166,0.0012284484,0.0002631791,0.00021478593,0.0016866231],"category_scores_gemma":[0.0011757324,0.00012920816,0.00037871278,0.0033742927,0.0006049544,0.0014357939,0.0006525988,0.00026249196,0.00030732382],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016917748,0.00015080429,0.10230199,0.0023793764,0.00015996092,0.0046795607,0.030564496,0.005585691,0.04405714,0.028114181,0.008201935,0.77363575],"study_design_scores_gemma":[0.000029208792,0.00015617894,0.60290164,0.0005999105,0.00034172533,0.003170382,0.047576554,0.14309849,0.021293815,0.04340695,0.13726665,0.00015854916],"about_ca_topic_score_codex":0.012891612,"about_ca_topic_score_gemma":0.031092267,"teacher_disagreement_score":0.012891612,"about_ca_system_score_codex":0.0011129152,"about_ca_system_score_gemma":0.0010469018,"threshold_uncertainty_score":0.025633156},"labels":[],"label_agreement":null},{"id":"W4408567745","doi":"10.61091/jcmcc124-31","title":"Exploring the trend of stylistic evolution of chinese modern and contemporary literary works based on big data analysis","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Big data; History; Literature; Chinese literature; Linguistics; Art; Computer science; China; Philosophy; Archaeology; Data mining","score_opus":0.09098774536056745,"score_gpt":0.3432634182296545,"score_spread":0.25227567286908703,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408567745","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9837028,0.0010406934,0.0038276168,0.00061011984,0.00006660179,0.00008902586,0.0023148824,0.000085905354,0.008262336],"genre_scores_gemma":[0.992588,0.00058288075,0.0032803887,0.00003452892,0.00006614924,0.00008464813,0.0015457954,0.000022474722,0.0017952158],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9990947,0.00013903448,0.00009815369,0.00015840861,0.00040664064,0.0001031467],"domain_scores_gemma":[0.9973495,0.00094677496,0.00052919844,0.0002550768,0.0007395781,0.00017981553],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009758008,0.00034429049,0.00035705895,0.011280206,0.0012656763,0.0022622375,0.0005076146,0.00033064192,0.0010815632],"category_scores_gemma":[0.0032147954,0.00019577866,0.0005043396,0.010738389,0.0008823348,0.00208458,0.0011476988,0.00039862838,0.0002741163],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021920589,0.0001047651,0.6516253,0.0010353497,0.00023982867,0.0019798742,0.04159602,0.0029130308,0.006510568,0.012889241,0.008679189,0.27220768],"study_design_scores_gemma":[0.000006743601,0.000048673628,0.9381159,0.00013661497,0.00008812529,0.00050884386,0.02228471,0.014771409,0.002130498,0.002879935,0.018962625,0.000065969565],"about_ca_topic_score_codex":0.008772837,"about_ca_topic_score_gemma":0.017569778,"teacher_disagreement_score":0.011280206,"about_ca_system_score_codex":0.0015648662,"about_ca_system_score_gemma":0.000980139,"threshold_uncertainty_score":0.017443597},"labels":[],"label_agreement":null},{"id":"W4409030284","doi":"10.1101/2025.03.30.25324911","title":"A Quarter-Century of Synthetic Data in Healthcare: Unveiling Trends with Structural Topic Modeling","year":2025,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Health care; Data science; Regional science; Computer science; History; Geography; Economics; Economic growth; Archaeology","score_opus":0.0794988932785872,"score_gpt":0.4060837622459037,"score_spread":0.32658486896731653,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409030284","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.43638846,0.0148892235,0.52160335,0.010968801,0.0006404358,0.00053119875,0.011233669,0.0007895478,0.002955295],"genre_scores_gemma":[0.9032846,0.0028376034,0.08304094,0.00052930077,0.0005874391,0.00058278476,0.008504152,0.00011121571,0.00052205176],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9860795,0.010327579,0.0008768895,0.0016973108,0.0007581323,0.00026059555],"domain_scores_gemma":[0.86948186,0.11521896,0.0068336506,0.004400255,0.00337734,0.000687857],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.028526545,0.0008277916,0.0010382645,0.006103255,0.0006719496,0.0035741313,0.0010463689,0.0011917584,0.0016237119],"category_scores_gemma":[0.076600455,0.00048326136,0.0018820766,0.007132216,0.0012102553,0.0030580594,0.0020000269,0.0016728992,0.00042067145],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012979351,0.00037002456,0.48133796,0.0051422506,0.0022968252,0.0010523824,0.007773243,0.15804708,0.003847348,0.054918624,0.021952393,0.2619639],"study_design_scores_gemma":[0.0001181926,0.00036644735,0.066932805,0.0009777298,0.0005973124,0.0005013257,0.0038415312,0.78563225,0.00210933,0.110986345,0.027818816,0.000117982454],"about_ca_topic_score_codex":0.003312212,"about_ca_topic_score_gemma":0.003278248,"teacher_disagreement_score":0.9938967,"about_ca_system_score_codex":0.0010233544,"about_ca_system_score_gemma":0.0011802117,"threshold_uncertainty_score":0.1508646},"labels":[],"label_agreement":null},{"id":"W4409075993","doi":"10.1111/cobi.14464","title":"New opportunities and challenges for conservation evidence synthesis from advances in natural language processing","year":2025,"lang":"en","type":"article","venue":"Conservation Biology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Nature Conservancy","keywords":"Computer science; Data science; Discipline; Scale (ratio); Artificial intelligence; Natural language; Social science; Sociology","score_opus":0.15998096968811973,"score_gpt":0.4236687871229636,"score_spread":0.2636878174348438,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409075993","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047143884,0.21601987,0.23432557,0.52669835,0.0027246578,0.0003343796,0.0009422633,0.00074432825,0.013496121],"genre_scores_gemma":[0.08765919,0.13982427,0.7282138,0.029849244,0.008745262,0.0013424711,0.0011216734,0.0006464802,0.0025975502],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9285896,0.05269661,0.0044443025,0.0045236223,0.008872771,0.0008731184],"domain_scores_gemma":[0.52216846,0.42674962,0.005821139,0.023967963,0.017875085,0.0034177003],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1608885,0.0019248805,0.0034967128,0.018362941,0.003028173,0.023168487,0.007361071,0.010018904,0.01187908],"category_scores_gemma":[0.23272721,0.0018166197,0.0034263835,0.01048876,0.017498871,0.044874836,0.012848045,0.010903413,0.0030937733],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026229845,0.00025367158,0.003753411,0.0115142865,0.00061636226,0.00042774988,0.0040061995,0.0072436295,0.0014899435,0.33778843,0.041022148,0.5916219],"study_design_scores_gemma":[0.000057955545,0.000058785576,0.0008958008,0.0035606865,0.00007320456,0.0001403985,0.0023148449,0.006908712,0.0005096563,0.90178347,0.08357295,0.00012349071],"about_ca_topic_score_codex":0.0035206822,"about_ca_topic_score_gemma":0.005318914,"teacher_disagreement_score":0.8391115,"about_ca_system_score_codex":0.0056156465,"about_ca_system_score_gemma":0.014748007,"threshold_uncertainty_score":0.85086983},"labels":[],"label_agreement":null},{"id":"W4409147784","doi":"10.1007/s40279-025-02212-7","title":"Response to Comment on: “A Machine Learning Approach to Concussion Risk Estimation Among Players Exhibiting Visible Signs in Professional Hockey”","year":2025,"lang":"en","type":"letter","venue":"Sports Medicine","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Toronto Rehabilitation Institute; York University; University of Toronto","funders":"","keywords":"Concussion; Sports medicine; Ice hockey; Physical medicine and rehabilitation; Physical therapy; Medicine; Injury prevention; Psychology; Poison control; Applied psychology; Medical emergency","score_opus":0.026311806204353402,"score_gpt":0.3561951011037354,"score_spread":0.329883294899382,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409147784","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00058705674,0.00033682186,0.00018219325,0.9772149,0.01931167,0.000050518556,0.00035300362,0.00005953602,0.0019043391],"genre_scores_gemma":[0.0012067182,0.00015042031,0.00016175817,0.98057806,0.010124981,0.00008474314,0.000063268126,0.000021331876,0.0076087494],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99213725,0.0014134953,0.0011129241,0.0012276971,0.0023231283,0.0017855292],"domain_scores_gemma":[0.97437006,0.012700916,0.001515872,0.0006220805,0.006471234,0.0043197176],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009050118,0.0014168627,0.002693069,0.0018049137,0.009616634,0.0067863474,0.0039462354,0.09872455,0.011889001],"category_scores_gemma":[0.046190158,0.0016240065,0.0029112273,0.0015802259,0.0041670077,0.0035968956,0.0033245934,0.06574142,0.014483174],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005265788,0.00003118621,0.0011127429,0.000041994892,0.00002337943,0.00035949406,0.00014897717,0.000049486473,0.00011615838,0.00068917224,0.99438584,0.0029889022],"study_design_scores_gemma":[0.00032363704,0.00021331599,0.01595081,0.0013267245,0.00019346568,0.00087516656,0.0027859272,0.00188553,0.0005577891,0.0071310108,0.96847737,0.00027932297],"about_ca_topic_score_codex":0.071586475,"about_ca_topic_score_gemma":0.11049397,"teacher_disagreement_score":0.09872455,"about_ca_system_score_codex":0.0105302585,"about_ca_system_score_gemma":0.015693385,"threshold_uncertainty_score":0.14233965},"labels":[],"label_agreement":null},{"id":"W4409403219","doi":"10.1007/978-3-031-87766-7_22","title":"Gender and Race Bias in Consumer Product Recommendations by Large Language Models","year":2025,"lang":"en","type":"book-chapter","venue":"Lecture notes on data engineering and communications technologies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Race (biology); Product (mathematics); Psychology; Computer science; Sociology; Gender studies; Mathematics","score_opus":0.09907225529256185,"score_gpt":0.35875855335889206,"score_spread":0.2596862980663302,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409403219","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8031706,0.0036583396,0.17385703,0.0047430713,0.00030343077,0.0000738323,0.0017281201,0.00082760875,0.011637921],"genre_scores_gemma":[0.97197545,0.0005232785,0.017583229,0.00032689085,0.0002391879,0.000045599812,0.0010318977,0.0001859987,0.00808854],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99707067,0.0020981312,0.00007579441,0.0004138232,0.00019845988,0.0001430207],"domain_scores_gemma":[0.9492047,0.047680493,0.00078367424,0.0014158727,0.0006627356,0.000252516],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0109820375,0.00053637964,0.00086307275,0.0010542274,0.00068563543,0.0019291101,0.0011719536,0.0012840482,0.0043116817],"category_scores_gemma":[0.029980438,0.0006318583,0.0017840994,0.0012448338,0.0010600075,0.003844165,0.0008483402,0.0024250387,0.0011484546],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037787035,0.000976685,0.21812059,0.00046797798,0.00244397,0.00089333596,0.0033750213,0.23362069,0.0087086,0.08581904,0.024431719,0.4173637],"study_design_scores_gemma":[0.000049140657,0.00010877366,0.02242398,0.00007179311,0.00026034337,0.00015900376,0.00035995047,0.9053018,0.0016719404,0.067645125,0.0018916772,0.00005655969],"about_ca_topic_score_codex":0.011023552,"about_ca_topic_score_gemma":0.0173966,"teacher_disagreement_score":0.011023552,"about_ca_system_score_codex":0.00091400254,"about_ca_system_score_gemma":0.00059836614,"threshold_uncertainty_score":0.058079243},"labels":[],"label_agreement":null},{"id":"W4409573352","doi":"10.61091/jcmcc127a-038","title":"Application of Artificial Intelligence-based Music Generation Technology in Popular Music Production","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Production (economics); Popular music; Computer science; Music technology; Multimedia; Artificial intelligence; Art; Visual arts; Music education","score_opus":0.040997300948043214,"score_gpt":0.3344577345785077,"score_spread":0.2934604336304645,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409573352","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04708148,0.0010624424,0.94302,0.00050403987,0.000118465534,0.000050873947,0.000078344776,0.0006149924,0.0074693477],"genre_scores_gemma":[0.84291404,0.0009315443,0.14877713,0.00026431814,0.00008752639,0.00006664863,0.00017618471,0.000078286685,0.006704331],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9996892,0.00008838579,0.000011213879,0.00008938655,0.000094767245,0.000027084987],"domain_scores_gemma":[0.9997018,0.00014752218,0.000033922624,0.00005387208,0.000048682454,0.000014221943],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006255544,0.00036561475,0.00028719916,0.0003849097,0.00018628065,0.00044748987,0.00059099816,0.00046429023,0.001411373],"category_scores_gemma":[0.0013368528,0.00017838592,0.0004372871,0.00035691058,0.0005140072,0.0007622692,0.0006029432,0.00066797686,0.0003959821],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014564524,0.00009656077,0.0031211772,0.00016901059,0.00012488398,0.0003363808,0.0002264266,0.5947866,0.035954032,0.03907082,0.0027283623,0.32324007],"study_design_scores_gemma":[0.000006013949,0.0000573904,0.00075045216,0.000010491225,0.000016288628,0.00008158524,0.000015224922,0.9825026,0.005778867,0.007826057,0.0029431337,0.000011954487],"about_ca_topic_score_codex":0.0014617787,"about_ca_topic_score_gemma":0.0014816625,"teacher_disagreement_score":0.0014617787,"about_ca_system_score_codex":0.0004188871,"about_ca_system_score_gemma":0.000284214,"threshold_uncertainty_score":0.0047215223},"labels":[],"label_agreement":null},{"id":"W4409573394","doi":"10.61091/jcmcc127a-028","title":"Analysis of Structured Data Processing and Aesthetic Experience in Classical Dance Theatre Works","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Dance; Aesthetics; Art; Visual arts; Computer science","score_opus":0.03522489619241412,"score_gpt":0.36924459367861795,"score_spread":0.33401969748620386,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409573394","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9607497,0.00037410556,0.031521216,0.00016256906,0.000055354816,0.00010070959,0.00061284326,0.00075024244,0.0056732087],"genre_scores_gemma":[0.98065156,0.00019503734,0.014086644,0.00004593736,0.00002219158,0.0000555674,0.0010146282,0.00007500881,0.0038534694],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99934846,0.00011107465,0.00003859494,0.00014631698,0.00028339383,0.00007207996],"domain_scores_gemma":[0.9994112,0.00021575401,0.000060201048,0.00010599645,0.00015152927,0.000055276472],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005109902,0.00045956913,0.00034390553,0.0011002561,0.00040025433,0.00082158507,0.00043128582,0.0003195504,0.0023208128],"category_scores_gemma":[0.0024204003,0.00014887283,0.00048709483,0.0010780061,0.00053806894,0.0011974507,0.0008321905,0.00036506687,0.00042848245],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015883987,0.00059848087,0.0867669,0.0011908647,0.00023779628,0.0020821441,0.0062422883,0.03673178,0.07637397,0.0039489726,0.014761096,0.76947725],"study_design_scores_gemma":[0.000077758006,0.0011217274,0.31636405,0.00014759437,0.00026518162,0.0015540171,0.012069175,0.57319045,0.066219315,0.006389344,0.022383824,0.00021762565],"about_ca_topic_score_codex":0.0030440672,"about_ca_topic_score_gemma":0.0048053428,"teacher_disagreement_score":0.0030440672,"about_ca_system_score_codex":0.0004706707,"about_ca_system_score_gemma":0.00024670424,"threshold_uncertainty_score":0.007763922},"labels":[],"label_agreement":null},{"id":"W4409576512","doi":"10.61091/jcmcc127a-124","title":"Criticism of Narrative Ethics in Chinese New Century Literature: a Cluster Analysis of AI Perspectives","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Criticism; Narrative; Cluster (spacecraft); Sociology; Literature; Art; Computer science","score_opus":0.01693656135965707,"score_gpt":0.37647751883153063,"score_spread":0.35954095747187353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409576512","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8824815,0.0017374054,0.03310603,0.0040685064,0.00012842698,0.0002985417,0.00011088755,0.000058088746,0.07801062],"genre_scores_gemma":[0.99340147,0.00036191268,0.0041845697,0.000075677985,0.000034424334,0.000067180496,0.00003687663,0.000009384328,0.0018284501],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9960084,0.0017820254,0.00023123944,0.0003473875,0.001354241,0.000276565],"domain_scores_gemma":[0.9933762,0.003739954,0.00092358806,0.0003571949,0.0013719241,0.0002312152],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004405016,0.00042692272,0.0003586306,0.00868381,0.004382085,0.0062073455,0.0007887569,0.0006881892,0.0016592962],"category_scores_gemma":[0.0106303925,0.00017816764,0.00051044277,0.0060459743,0.008284414,0.003506283,0.0025132129,0.00078522175,0.00009664186],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015521239,0.000058575788,0.054310992,0.0004555225,0.00010787081,0.0015921989,0.5420446,0.0022585392,0.0019553038,0.2924557,0.0034448137,0.101160735],"study_design_scores_gemma":[0.000038436858,0.00008538275,0.14321001,0.0006352915,0.00016158988,0.0009762391,0.59881,0.034751654,0.0035337573,0.14168748,0.07594943,0.00016073257],"about_ca_topic_score_codex":0.010824115,"about_ca_topic_score_gemma":0.0087440945,"teacher_disagreement_score":0.010824115,"about_ca_system_score_codex":0.0072701043,"about_ca_system_score_gemma":0.0041943854,"threshold_uncertainty_score":0.0527485},"labels":[],"label_agreement":null},{"id":"W4409576537","doi":"10.61091/jcmcc127a-150","title":"A study on the application of graph convolutional network based joint model in entity relationship extraction","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Graph; Entity–relationship model; Artificial intelligence; Natural language processing; Theoretical computer science; Information retrieval; Relational database","score_opus":0.055298366138905326,"score_gpt":0.3606994750947332,"score_spread":0.3054011089558279,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409576537","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22223131,0.0032421767,0.7634693,0.001422674,0.00023976165,0.00015081165,0.00073821296,0.0027646513,0.005741105],"genre_scores_gemma":[0.830954,0.0020165853,0.15717275,0.00040179657,0.000100247846,0.00012055673,0.0029832644,0.00017147874,0.0060794],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99934787,0.00017452701,0.000039036982,0.00023847462,0.000119729855,0.00008032465],"domain_scores_gemma":[0.99880445,0.0005764352,0.00008081223,0.00024934733,0.00024680456,0.000042123615],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017783307,0.0010747818,0.0007122464,0.0013555294,0.0004529551,0.00086857704,0.0012977385,0.0010168479,0.0014012228],"category_scores_gemma":[0.003817898,0.0003210118,0.0010410482,0.002022524,0.0004491955,0.0041012904,0.0007904164,0.0011647829,0.00045542466],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041636665,0.00042593692,0.011129898,0.000300302,0.00038452054,0.00048508716,0.00017668396,0.4418186,0.016023709,0.020816084,0.009090559,0.4989322],"study_design_scores_gemma":[0.0000038773974,0.000022187536,0.00060025795,0.000004791939,0.00002907685,0.00003211863,0.000010004837,0.99375004,0.0021535016,0.0025543426,0.00083469437,0.0000050684257],"about_ca_topic_score_codex":0.013675578,"about_ca_topic_score_gemma":0.013497349,"teacher_disagreement_score":0.013675578,"about_ca_system_score_codex":0.001128754,"about_ca_system_score_gemma":0.0011263035,"threshold_uncertainty_score":0.027191937},"labels":[],"label_agreement":null},{"id":"W4409602019","doi":"10.61091/jcmcc127b-070","title":"Exploring Emotion Analysis in Modern Chinese Fiction Using AI Technology","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Art; Literature; Psychology","score_opus":0.04625276920904937,"score_gpt":0.35620690903021784,"score_spread":0.3099541398211685,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409602019","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8840671,0.0022763624,0.0951866,0.00083310675,0.0001769891,0.00017364975,0.001168873,0.0008161092,0.015301173],"genre_scores_gemma":[0.9607786,0.00095370127,0.03171749,0.00010377441,0.00014317986,0.000090348316,0.0010972407,0.00003858113,0.0050770217],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99985766,0.000024152747,0.000008451472,0.000040407063,0.00004393392,0.000025367734],"domain_scores_gemma":[0.99977034,0.00010310145,0.000034751127,0.000017478696,0.00005812441,0.00001613969],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00020601429,0.00048822165,0.00021520742,0.0018209923,0.00034941646,0.00075499795,0.00030440048,0.00029799566,0.0016678998],"category_scores_gemma":[0.0010146904,0.000098620716,0.00049998617,0.0010769187,0.00029049107,0.0009239484,0.00038669657,0.0003197128,0.0003631934],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004080695,0.00021010636,0.043481726,0.0011792787,0.000278316,0.00271637,0.004936698,0.038464233,0.110414006,0.01132426,0.014255731,0.7723312],"study_design_scores_gemma":[0.000026323152,0.00019155297,0.16747059,0.00009282324,0.00018646191,0.0010152111,0.0031473192,0.75947213,0.03217972,0.0104007535,0.0257261,0.00009101981],"about_ca_topic_score_codex":0.0026148069,"about_ca_topic_score_gemma":0.0029370163,"teacher_disagreement_score":0.0026148069,"about_ca_system_score_codex":0.0004879659,"about_ca_system_score_gemma":0.00020726242,"threshold_uncertainty_score":0.0055796504},"labels":[],"label_agreement":null},{"id":"W4409603684","doi":"10.61091/jcmcc127b-240","title":"A Study of Using Principal Component Analysis to Enhance Semantic Role Annotation in Chinese Autoanalysis","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Principal component analysis; Annotation; Natural language processing; Computer science; Component (thermodynamics); Information retrieval; Artificial intelligence","score_opus":0.01846439807144693,"score_gpt":0.3765999545253375,"score_spread":0.35813555645389056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409603684","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1738891,0.0009332417,0.81242114,0.000701169,0.0001317886,0.00023493926,0.000090121524,0.0013844989,0.0102139525],"genre_scores_gemma":[0.67803836,0.00082003244,0.31705454,0.00014529172,0.00006343035,0.000167224,0.00016385906,0.00020173125,0.0033454658],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976433,0.0012212408,0.00012398888,0.0004193384,0.0004696943,0.00012236103],"domain_scores_gemma":[0.9954442,0.0028246439,0.00018791849,0.0003374253,0.0011212135,0.000084611886],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033729735,0.0008113238,0.00038174528,0.00217614,0.00096416264,0.0014456669,0.0006117425,0.0004240953,0.0015361389],"category_scores_gemma":[0.010702377,0.00036667884,0.0006705854,0.0024554492,0.0009156361,0.0034795334,0.00089079904,0.00071272376,0.00035757027],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026060623,0.00022637675,0.020053277,0.0006202371,0.00014956483,0.0002737169,0.004638033,0.013651048,0.023940394,0.033149958,0.0047283866,0.89830834],"study_design_scores_gemma":[0.00005519975,0.00028451585,0.038308136,0.00013200399,0.00039224845,0.00043421873,0.0025578812,0.8563607,0.05199727,0.028607849,0.020706823,0.0001631671],"about_ca_topic_score_codex":0.011887338,"about_ca_topic_score_gemma":0.008467349,"teacher_disagreement_score":0.011887338,"about_ca_system_score_codex":0.000951241,"about_ca_system_score_gemma":0.0017302576,"threshold_uncertainty_score":0.023636281},"labels":[],"label_agreement":null},{"id":"W4409677269","doi":"10.31235/osf.io/3arux_v1","title":"Reliability of the Core Items in the General Social Survey: Estimates from the Three-wave Panels, 2006-2014","year":2016,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Nutrition Obesity Research Center, University of North Carolina; York University; National Science Foundation","keywords":"Core (optical fiber); Reliability (semiconductor); Psychology; Statistics; Computer science; Reliability engineering; Econometrics; Mathematics; Engineering; Physics; Telecommunications; Quantum mechanics","score_opus":0.15812412207878535,"score_gpt":0.3925154096363683,"score_spread":0.23439128755758293,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409677269","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.94634867,0.00030452455,0.018523235,0.0005690022,0.00007103305,0.0002953302,0.028605426,0.00016647659,0.005116248],"genre_scores_gemma":[0.9724462,0.00011746181,0.006414843,0.00008884147,0.000033956057,0.0006586551,0.019037627,0.000063569685,0.0011387042],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98857784,0.0059619853,0.00095850875,0.0018197863,0.0019429341,0.00073900627],"domain_scores_gemma":[0.9530525,0.024169931,0.008511659,0.007595136,0.0059920815,0.0006787137],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.024151275,0.0005486685,0.00093405304,0.0029394343,0.00086407695,0.0013058473,0.0011209218,0.00076389406,0.0043669143],"category_scores_gemma":[0.05464307,0.0005982897,0.0018609689,0.005270601,0.0013706393,0.0012761421,0.002911396,0.0017252022,0.0010538709],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000082872306,0.000055923447,0.97881854,0.00011108402,0.0007787022,0.0000377632,0.0020015498,0.0027461168,0.00018977441,0.002132269,0.006123551,0.0069217747],"study_design_scores_gemma":[0.00002001531,0.000059095364,0.9876474,0.000067787165,0.00021482645,0.000047046462,0.0008668288,0.0046651084,0.00029012404,0.0015735135,0.004512663,0.00003570859],"about_ca_topic_score_codex":0.032946214,"about_ca_topic_score_gemma":0.024740009,"teacher_disagreement_score":0.97584873,"about_ca_system_score_codex":0.0011906945,"about_ca_system_score_gemma":0.0014969427,"threshold_uncertainty_score":0.12772572},"labels":[],"label_agreement":null},{"id":"W4409787564","doi":"10.61091/jcmcc127a-401","title":"A study on optimizing deep learning models for creative generation of animated new media advertisements: an application based on improved generative adversarial networks (GANs) and variational autocoders (VAEs)","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Generative grammar; Adversarial system; Computer science; Artificial intelligence; Deep learning; Generative adversarial network; Generative model; Machine learning; Multimedia","score_opus":0.0424589621275114,"score_gpt":0.3377650313920022,"score_spread":0.2953060692644908,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409787564","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.070304856,0.0014766228,0.92223305,0.00049903936,0.000090992515,0.000078186975,0.000045893492,0.00046952735,0.004801815],"genre_scores_gemma":[0.87419254,0.00084056595,0.11923121,0.00027514307,0.00005941852,0.00011503409,0.00013352401,0.0001118318,0.0050408733],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999585,0.00015521106,0.000017219625,0.00011254003,0.00008177114,0.000048316808],"domain_scores_gemma":[0.99876356,0.00088800385,0.000070809416,0.00008337606,0.00014404347,0.00005016631],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016940427,0.000948874,0.0006629403,0.0003743127,0.00021110014,0.0007306151,0.0009829393,0.0009022661,0.001346338],"category_scores_gemma":[0.0033392136,0.00043726273,0.00069903163,0.00031260896,0.0006347997,0.0011230984,0.0007593152,0.0014124904,0.00021433402],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053352946,0.000049815855,0.0007641517,0.000067361456,0.000044484797,0.000051606068,0.000047387697,0.9448397,0.0026445817,0.0072832955,0.00067875895,0.04347546],"study_design_scores_gemma":[0.0000024252322,0.000017405826,0.000052000334,0.000002834946,0.000004192016,0.000008148856,0.000002445671,0.99870515,0.00042282647,0.0006394229,0.00014134563,0.000001833018],"about_ca_topic_score_codex":0.0041690012,"about_ca_topic_score_gemma":0.0026341921,"teacher_disagreement_score":0.0041690012,"about_ca_system_score_codex":0.0007847838,"about_ca_system_score_gemma":0.000665814,"threshold_uncertainty_score":0.008959055},"labels":[],"label_agreement":null},{"id":"W4409787746","doi":"10.61091/jcmcc127a-485","title":"A quantitative study of stylistic differences between Giacometti and his contemporaries based on big data modeling","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Big data; Computer science; Psychology; Artificial intelligence; Data mining","score_opus":0.15305001447283495,"score_gpt":0.39186707274468047,"score_spread":0.23881705827184552,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409787746","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80655503,0.0039526285,0.014856666,0.002768947,0.00035957972,0.00008817344,0.0008845167,0.00019660397,0.17033777],"genre_scores_gemma":[0.9906583,0.0009138184,0.0037622664,0.00015230408,0.000114838804,0.00003399573,0.00029325424,0.00005076931,0.004020596],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9983712,0.00039839893,0.000091757756,0.00026186387,0.00072485884,0.00015198215],"domain_scores_gemma":[0.99533516,0.0025559806,0.00079334027,0.0004994324,0.00045003364,0.0003660306],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018919602,0.00035453503,0.00032532818,0.0074932342,0.0025571561,0.004980915,0.0005616163,0.0006131068,0.0023138248],"category_scores_gemma":[0.011072526,0.00020694846,0.00030672053,0.0088703325,0.003989348,0.0035029175,0.0021456839,0.0010128408,0.000509737],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050333387,0.000070967166,0.121126175,0.0007521215,0.00015991264,0.0025434284,0.18122627,0.0040545305,0.0049765916,0.47853306,0.016340107,0.18971357],"study_design_scores_gemma":[0.00003311998,0.00020667717,0.3096937,0.00063729566,0.000127999,0.004891638,0.07146477,0.022157935,0.0041849934,0.15084773,0.43543705,0.00031709802],"about_ca_topic_score_codex":0.0024100223,"about_ca_topic_score_gemma":0.004496305,"teacher_disagreement_score":0.0074932342,"about_ca_system_score_codex":0.0022196695,"about_ca_system_score_gemma":0.0006997312,"threshold_uncertainty_score":0.016104877},"labels":[],"label_agreement":null},{"id":"W4409791120","doi":"10.61091/jcmcc127a-321","title":"Research on Multimodal Generation Strategy of Opera Style and Music Melody Based on Time Series Analysis","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Opera; Style (visual arts); Series (stratigraphy); Speech recognition; Style analysis; Computer science; Art; Literature","score_opus":0.053671529995958395,"score_gpt":0.3863430329613581,"score_spread":0.3326715029653997,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409791120","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.071998104,0.001217809,0.92020893,0.000316535,0.00007245907,0.00003077109,0.00006488087,0.00029770215,0.0057929233],"genre_scores_gemma":[0.9417647,0.00097050867,0.051126648,0.00008367652,0.000053586893,0.00004075805,0.00013375704,0.00006223995,0.0057642004],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99976164,0.000053252003,0.000009875528,0.000082598744,0.000062523446,0.000030000052],"domain_scores_gemma":[0.9996388,0.00018629208,0.000049425234,0.00003553203,0.000062312014,0.000027621169],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005786193,0.0005613805,0.00041471384,0.00039179274,0.00019126273,0.00046851495,0.0006042888,0.000365521,0.0016284053],"category_scores_gemma":[0.0015455001,0.00022841757,0.0005922847,0.00038003593,0.0003436985,0.0009038808,0.0003502711,0.0007040315,0.00024827174],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009863021,0.00008763523,0.0062373085,0.00014970053,0.00014406875,0.00018001399,0.00016720923,0.74529004,0.018570824,0.030587913,0.0015449981,0.1969417],"study_design_scores_gemma":[0.0000021249837,0.000018369668,0.00055969856,0.0000028491722,0.0000114361455,0.000024953504,0.0000073802253,0.9960247,0.0009146474,0.002043085,0.00038613766,0.000004479348],"about_ca_topic_score_codex":0.0031966723,"about_ca_topic_score_gemma":0.0021853196,"teacher_disagreement_score":0.0031966723,"about_ca_system_score_codex":0.000419118,"about_ca_system_score_gemma":0.0003975779,"threshold_uncertainty_score":0.0063561797},"labels":[],"label_agreement":null},{"id":"W4409793620","doi":"10.61091/jcmcc127a-183","title":"A Study on the Linguistic Adaptation of Language Modeling Techniques in Translating British Victorian Literature","year":2025,"lang":"en","type":"article","venue":"Journal of Combinatorial Mathematics and Combinatorial Computing","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Linguistics; Adaptation (eye); Computer science; History; Natural language processing; Psychology; Philosophy","score_opus":0.026204361811653743,"score_gpt":0.342007382365916,"score_spread":0.31580302055426224,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409793620","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6805292,0.005213818,0.271532,0.0013572512,0.00025062988,0.0003181848,0.00017154161,0.00094386097,0.039683547],"genre_scores_gemma":[0.88661915,0.0021094051,0.09922468,0.00027032424,0.00005374837,0.00009345675,0.0003437254,0.00014746905,0.0111379195],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987821,0.0006149061,0.00007659,0.0002055184,0.00026661096,0.00005436677],"domain_scores_gemma":[0.998572,0.0007133035,0.000097185024,0.00019741575,0.00038467048,0.0000354667],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019490914,0.00042982178,0.00034477466,0.0007865731,0.00069519307,0.0009927077,0.00057641335,0.0004306314,0.0011631808],"category_scores_gemma":[0.0069335937,0.00022401255,0.0004184958,0.0016151214,0.000542702,0.0015412582,0.00052600534,0.0006717044,0.00043794457],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029632827,0.00022766305,0.014739248,0.0007959471,0.000150795,0.00069222756,0.006111841,0.059455376,0.06308517,0.02047267,0.0027713024,0.8312014],"study_design_scores_gemma":[0.00005779781,0.00083056657,0.046732523,0.00035337207,0.000381673,0.0022406306,0.0042034746,0.7665113,0.07966046,0.015188789,0.083654776,0.0001845986],"about_ca_topic_score_codex":0.025782421,"about_ca_topic_score_gemma":0.018557863,"teacher_disagreement_score":0.025782421,"about_ca_system_score_codex":0.0013367572,"about_ca_system_score_gemma":0.0016403783,"threshold_uncertainty_score":0.051264644},"labels":[],"label_agreement":null},{"id":"W4409839934","doi":"10.31219/osf.io/bxr54_v1","title":"A comparison of regularization, alignment, and a traditional method for estimating structural relationships across multiple groups","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Regularization (linguistics); Mathematics; Computer science; Econometrics; Algorithm; Statistics; Artificial intelligence","score_opus":0.20116553013221206,"score_gpt":0.4804033402469206,"score_spread":0.27923781011470855,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409839934","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027543081,0.0005295215,0.96909505,0.0006451711,0.00007929914,0.00019087369,0.00012088804,0.00029981116,0.0014963122],"genre_scores_gemma":[0.15023078,0.00032779877,0.84703374,0.0002085628,0.00006918345,0.0007352908,0.00038212052,0.00022075011,0.0007917879],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96321803,0.0304313,0.0008087256,0.0021828,0.0029909613,0.00036821302],"domain_scores_gemma":[0.88393885,0.093851656,0.004813742,0.011472153,0.005138866,0.00078472204],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.045978017,0.0013932023,0.0018398409,0.002701396,0.0010765484,0.0017479048,0.0019162949,0.0018574169,0.0019346623],"category_scores_gemma":[0.15006872,0.0005958893,0.0018714177,0.004316649,0.0024225472,0.0048276754,0.0025326153,0.0033082378,0.0005519886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019054189,0.0007769569,0.02838391,0.0009974802,0.001341738,0.00016579135,0.002216036,0.14716011,0.005413032,0.18215376,0.007188614,0.6222972],"study_design_scores_gemma":[0.00034100967,0.0006468092,0.01190659,0.00029315485,0.00021785064,0.00023491785,0.0005361002,0.86186236,0.0035061322,0.11375999,0.006509466,0.0001855856],"about_ca_topic_score_codex":0.0032491493,"about_ca_topic_score_gemma":0.004633627,"teacher_disagreement_score":0.045978017,"about_ca_system_score_codex":0.0013906673,"about_ca_system_score_gemma":0.0033310936,"threshold_uncertainty_score":0.24315792},"labels":[],"label_agreement":null},{"id":"W4409884241","doi":"10.31219/osf.io/bxr54_v3","title":"A comparison of regularization, alignment, and a traditional method for estimating structural relationships across multiple groups","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Regularization (linguistics); Computer science; Mathematics; Econometrics; Statistics; Artificial intelligence","score_opus":0.19563670662163202,"score_gpt":0.48320841440762297,"score_spread":0.28757170778599095,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409884241","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03851678,0.0004062917,0.9582092,0.0006025207,0.00006986114,0.0001807824,0.00012092433,0.00039473822,0.0014988617],"genre_scores_gemma":[0.167336,0.00021524077,0.83005285,0.00016042068,0.00006080468,0.00051780156,0.00037987597,0.0002443465,0.0010326967],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9788138,0.017659295,0.00043495296,0.0013389512,0.0014934081,0.0002594099],"domain_scores_gemma":[0.93148506,0.05561352,0.0029296668,0.006468855,0.0029120287,0.0005908291],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.030950619,0.001174208,0.0014678534,0.002162464,0.0009049442,0.0014893855,0.0017283807,0.0014947918,0.0020518573],"category_scores_gemma":[0.09340444,0.00052996195,0.0014139957,0.003431738,0.0017878371,0.0033465058,0.002410552,0.0027770111,0.0004969202],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017573215,0.000788117,0.022049207,0.0007310601,0.00094218407,0.00013882194,0.0016934618,0.1601701,0.004932376,0.12447413,0.0065288246,0.6757943],"study_design_scores_gemma":[0.00019855713,0.00041539918,0.0062878462,0.00012475994,0.00010671569,0.00011497262,0.00030616063,0.9272948,0.002134334,0.059424967,0.0034998087,0.000091741385],"about_ca_topic_score_codex":0.002919166,"about_ca_topic_score_gemma":0.004157594,"teacher_disagreement_score":0.030950619,"about_ca_system_score_codex":0.0011336893,"about_ca_system_score_gemma":0.0027623076,"threshold_uncertainty_score":0.16368449},"labels":[],"label_agreement":null},{"id":"W4409985521","doi":"10.1109/access.2025.3566014","title":"Voices of People With Disabilities: Integrating Topic Modeling and Sentiment Analysis to Study Disability Discourse on Social Media","year":2025,"lang":"en","type":"article","venue":"IEEE Access","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"University of Saskatchewan; Pennsylvania State University","keywords":"Social media; Sentiment analysis; Computer science; Social model of disability; Natural language processing; World Wide Web; Psychology","score_opus":0.06817796140879107,"score_gpt":0.4542187480921701,"score_spread":0.38604078668337904,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409985521","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9661962,0.00086287805,0.02227238,0.0014101285,0.00013089522,0.0005897263,0.0032290278,0.00014736482,0.005161372],"genre_scores_gemma":[0.96155494,0.0007458377,0.031277806,0.00028265844,0.00018158517,0.0009043983,0.002875637,0.000068906906,0.0021082095],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9977513,0.001299307,0.00016623453,0.00028181818,0.00034136183,0.00015992412],"domain_scores_gemma":[0.9913565,0.0066627646,0.000892662,0.00020423612,0.0006867609,0.00019717241],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003554402,0.0006653389,0.00043239628,0.0044061183,0.0010312658,0.0022035094,0.00046059076,0.00066808856,0.0012072404],"category_scores_gemma":[0.008364456,0.00021917588,0.000815077,0.0028955692,0.0006836128,0.002831423,0.001613211,0.00083565235,0.0005673952],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00096379174,0.00065908884,0.28869593,0.0034517406,0.00033187866,0.0019343205,0.3139086,0.004785944,0.030890308,0.007000486,0.0145582,0.33281973],"study_design_scores_gemma":[0.00007889243,0.0004665048,0.35048923,0.0011175751,0.0003045947,0.0010173259,0.40518743,0.15257484,0.00956633,0.010703807,0.06820425,0.00028929516],"about_ca_topic_score_codex":0.0038761601,"about_ca_topic_score_gemma":0.006559024,"teacher_disagreement_score":0.0044061183,"about_ca_system_score_codex":0.0009857725,"about_ca_system_score_gemma":0.0005665937,"threshold_uncertainty_score":0.018797696},"labels":[],"label_agreement":null},{"id":"W4409985601","doi":"10.32396/usurj.v10i1.812","title":"\"The Grass is Always Greener\" and \"Questions for AI\"","year":2025,"lang":"en","type":"article","venue":"USURJ University of Saskatchewan Undergraduate Research Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Agroforestry; Environmental science","score_opus":0.05211360939955588,"score_gpt":0.388410539014883,"score_spread":0.3362969296153271,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409985601","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041496504,0.009315332,0.08592801,0.32572794,0.007529558,0.00019033412,0.00043958976,0.0008378711,0.5285348],"genre_scores_gemma":[0.5394601,0.0064067626,0.06130152,0.09626133,0.0029110594,0.00043135032,0.00047397747,0.0013406923,0.2914131],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99056447,0.006242965,0.00018792516,0.00076968304,0.00194841,0.0002866413],"domain_scores_gemma":[0.9873016,0.008797397,0.000664075,0.0012846645,0.0012041451,0.0007481169],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007116458,0.0007279099,0.00031483872,0.0013676534,0.0050279987,0.0115365265,0.00096915435,0.0034550435,0.023286676],"category_scores_gemma":[0.021154556,0.00037291046,0.00047940738,0.0011179493,0.027468743,0.014038393,0.004694102,0.0060045067,0.0040380103],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000040046405,0.000040900053,0.0010059715,0.00016733907,0.000013556397,0.00022952753,0.04936748,0.00010835932,0.00087727077,0.76420707,0.13577747,0.048165053],"study_design_scores_gemma":[0.000011716083,0.000023559562,0.0011122685,0.00037237344,0.000008316635,0.0005187693,0.034855325,0.00038848392,0.0008652623,0.2680797,0.6937299,0.000034353707],"about_ca_topic_score_codex":0.0030664487,"about_ca_topic_score_gemma":0.005935164,"teacher_disagreement_score":0.023286676,"about_ca_system_score_codex":0.00375181,"about_ca_system_score_gemma":0.0023222908,"threshold_uncertainty_score":0.07790166},"labels":[],"label_agreement":null},{"id":"W4409999884","doi":"10.32920/28915823.v1","title":"Using Source Tracking AI to Analyze News Coverage about First Nations, Indigenous and Métis Communities","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Indigenous; Tracking (education); Metis; Political science; Geography; Computer science; Sociology; World Wide Web; Biology; Ecology","score_opus":0.07351205673171586,"score_gpt":0.4069174012741839,"score_spread":0.33340534454246806,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409999884","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.81412894,0.0025443977,0.062170383,0.0029340365,0.0002832584,0.001398244,0.052244525,0.002237467,0.062058765],"genre_scores_gemma":[0.8285395,0.001680609,0.114855096,0.00036860176,0.00024658337,0.00079968025,0.04307602,0.00029379173,0.010140127],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9961068,0.0010948498,0.00038083023,0.0006347358,0.0014979215,0.00028478997],"domain_scores_gemma":[0.9336962,0.04233757,0.0066807778,0.003925266,0.011944478,0.0014156519],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006849935,0.00048583592,0.00033980276,0.034375794,0.0026857734,0.006390891,0.0008767002,0.0006751755,0.00204668],"category_scores_gemma":[0.038749952,0.00024094293,0.00033411867,0.028763104,0.0010988782,0.002658914,0.0020572736,0.00072577724,0.0006439455],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000496774,0.00022561445,0.32810077,0.0018783676,0.00035493626,0.0009131409,0.07771767,0.0022891473,0.010933143,0.011966238,0.020195194,0.544929],"study_design_scores_gemma":[0.00007185017,0.00011934492,0.6430979,0.0010504863,0.00044195182,0.0005848292,0.07163741,0.044156797,0.017588053,0.011451171,0.20953456,0.0002655825],"about_ca_topic_score_codex":0.39848572,"about_ca_topic_score_gemma":0.43907607,"teacher_disagreement_score":0.6015143,"about_ca_system_score_codex":0.005539726,"about_ca_system_score_gemma":0.009337183,"threshold_uncertainty_score":0.79233253},"labels":[],"label_agreement":null},{"id":"W4410000006","doi":"10.32920/28915823","title":"Using Source Tracking AI to Analyze News Coverage about First Nations, Indigenous and Métis Communities","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Indigenous; Tracking (education); Political science; Geography; Computer science; Sociology; Ecology; Biology","score_opus":0.07351205673171586,"score_gpt":0.4069174012741839,"score_spread":0.33340534454246806,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410000006","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.81412894,0.0025443977,0.062170383,0.0029340365,0.0002832584,0.001398244,0.052244525,0.002237467,0.062058765],"genre_scores_gemma":[0.8285395,0.001680609,0.114855096,0.00036860176,0.00024658337,0.00079968025,0.04307602,0.00029379173,0.010140127],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9961068,0.0010948498,0.00038083023,0.0006347358,0.0014979215,0.00028478997],"domain_scores_gemma":[0.9336962,0.04233757,0.0066807778,0.003925266,0.011944478,0.0014156519],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006849935,0.00048583592,0.00033980276,0.034375794,0.0026857734,0.006390891,0.0008767002,0.0006751755,0.00204668],"category_scores_gemma":[0.038749952,0.00024094293,0.00033411867,0.028763104,0.0010988782,0.002658914,0.0020572736,0.00072577724,0.0006439455],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000496774,0.00022561445,0.32810077,0.0018783676,0.00035493626,0.0009131409,0.07771767,0.0022891473,0.010933143,0.011966238,0.020195194,0.544929],"study_design_scores_gemma":[0.00007185017,0.00011934492,0.6430979,0.0010504863,0.00044195182,0.0005848292,0.07163741,0.044156797,0.017588053,0.011451171,0.20953456,0.0002655825],"about_ca_topic_score_codex":0.39848572,"about_ca_topic_score_gemma":0.43907607,"teacher_disagreement_score":0.6015143,"about_ca_system_score_codex":0.005539726,"about_ca_system_score_gemma":0.009337183,"threshold_uncertainty_score":0.79233253},"labels":[],"label_agreement":null},{"id":"W4410049368","doi":"10.1145/3680256.3721264","title":"RPerf: Mining User Reviews Using Topic Modeling to Assist Performance Testing: An Industrial Experience Report","year":2025,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Data science","score_opus":0.4860696138779827,"score_gpt":0.502013129840431,"score_spread":0.015943515962448307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410049368","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.54816234,0.005414885,0.3767179,0.0044442704,0.00059968245,0.0030394557,0.016035361,0.03409077,0.011495336],"genre_scores_gemma":[0.5923795,0.0016589626,0.3780652,0.0005066423,0.00038625003,0.0013909936,0.017535737,0.001345892,0.006730798],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.9849797,0.0076522757,0.0012455945,0.0014429616,0.004394045,0.00028541475],"domain_scores_gemma":[0.88295484,0.081153706,0.0057917014,0.0064537507,0.022116153,0.0015298297],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01879987,0.0014000935,0.0010039863,0.0070195817,0.0009335588,0.0024076402,0.0014612783,0.00094286754,0.0016459438],"category_scores_gemma":[0.066796035,0.0004859776,0.0009839498,0.00321664,0.00037326128,0.002542568,0.0010998542,0.0012297285,0.0019814605],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005470687,0.0011545627,0.062344994,0.002081302,0.00042744903,0.00050032465,0.006955362,0.009044088,0.017803593,0.001522316,0.07452133,0.82309765],"study_design_scores_gemma":[0.00028766686,0.0030784635,0.1544921,0.000661122,0.00070270506,0.001760198,0.0062103528,0.64928305,0.045276288,0.0035208964,0.13412778,0.00059936004],"about_ca_topic_score_codex":0.0058096666,"about_ca_topic_score_gemma":0.0081698,"teacher_disagreement_score":0.01879987,"about_ca_system_score_codex":0.0009565285,"about_ca_system_score_gemma":0.0013571861,"threshold_uncertainty_score":0.09942442},"labels":[],"label_agreement":null},{"id":"W4410554739","doi":"10.1177/00491241251339188","title":"Updating “The Future of Coding”: Qualitative Coding with Generative Large Language Models","year":2025,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Russell Sage Foundation","keywords":"Coding (social sciences); Generative grammar; Computer science; Natural language processing; Linguistics; Qualitative research; Artificial intelligence; Sociology; Social science","score_opus":0.2818745422435381,"score_gpt":0.6225325648240265,"score_spread":0.34065802258048844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410554739","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013570337,0.00048650499,0.9591738,0.0150591545,0.0005261713,0.0005324371,0.0007495381,0.0008488533,0.0090532135],"genre_scores_gemma":[0.26039404,0.0005273927,0.72806484,0.0037896882,0.00019456912,0.0027355754,0.00077858864,0.0011223872,0.0023928918],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.79852194,0.17828849,0.0042303666,0.007846711,0.010018296,0.0010941626],"domain_scores_gemma":[0.48587582,0.38830906,0.014182528,0.07850019,0.030917224,0.0022152774],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1450383,0.0014232078,0.00096254126,0.0040986715,0.004843164,0.0121858185,0.0049872175,0.0027984455,0.009748672],"category_scores_gemma":[0.44464272,0.0015567829,0.001525877,0.004195776,0.026945742,0.024387859,0.010678987,0.0067634475,0.0026235436],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001875412,0.000070704875,0.004540558,0.00127844,0.00009679854,0.00019573024,0.13612004,0.006370578,0.001849917,0.7195998,0.014411542,0.11527831],"study_design_scores_gemma":[0.00007219223,0.00003979199,0.00080979837,0.0015922155,0.000037388458,0.00017526568,0.018668812,0.03233928,0.0029460217,0.8712533,0.071906276,0.00015968915],"about_ca_topic_score_codex":0.006793946,"about_ca_topic_score_gemma":0.008921273,"teacher_disagreement_score":0.8549617,"about_ca_system_score_codex":0.0102128135,"about_ca_system_score_gemma":0.014738672,"threshold_uncertainty_score":0.767045},"labels":[],"label_agreement":null},{"id":"W4410695830","doi":"10.1101/2025.05.20.655151","title":"Sampling Aware Ancestral State Inference","year":2025,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; Simon Fraser University; Michael Smith Health Research BC; Strong; Public Health Agency; Public Health Agency of Canada","keywords":"Inference; Sampling (signal processing); State (computer science); Computer science; Statistics; Econometrics; Mathematics; Artificial intelligence; Algorithm","score_opus":0.056515198160792174,"score_gpt":0.3516928275629704,"score_spread":0.2951776294021782,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410695830","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013424521,0.00041044847,0.97623116,0.0005328468,0.00012577203,0.00011446182,0.0038843527,0.0034153173,0.0018611494],"genre_scores_gemma":[0.22284538,0.00053725555,0.75731343,0.0005724165,0.00025635,0.00056370464,0.014026891,0.0012195264,0.00266504],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99634874,0.0019567332,0.00022054401,0.0009555095,0.00036755984,0.00015081288],"domain_scores_gemma":[0.9794223,0.015254186,0.0007820398,0.0035867547,0.0007300488,0.00022464567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007767887,0.0010405494,0.0012756111,0.0028991525,0.0017106876,0.0026208502,0.0020959107,0.001913802,0.009014289],"category_scores_gemma":[0.050175447,0.0009930634,0.0021443581,0.003549946,0.0014091214,0.0039275107,0.0027175753,0.0041391854,0.003005593],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007952666,0.00028812067,0.045965765,0.001114634,0.0012021263,0.00080092164,0.0027327163,0.19108522,0.0061102537,0.22047956,0.0522759,0.47714955],"study_design_scores_gemma":[0.00007737158,0.00003089854,0.0022230356,0.00011742476,0.00012867298,0.0002473441,0.00020381041,0.67266566,0.0028346393,0.3053751,0.016033195,0.00006280896],"about_ca_topic_score_codex":0.0042333356,"about_ca_topic_score_gemma":0.009080557,"teacher_disagreement_score":0.009014289,"about_ca_system_score_codex":0.00090463937,"about_ca_system_score_gemma":0.0030231979,"threshold_uncertainty_score":0.04108101},"labels":[],"label_agreement":null},{"id":"W4410705181","doi":"10.29173/cais1874","title":"Conceptualizations of Information Science by Large Language Models","year":2025,"lang":"fr","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Linguistics; Cognitive science; Psychology; Philosophy","score_opus":0.02162641806700447,"score_gpt":0.31367071863813933,"score_spread":0.29204430057113484,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410705181","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18743658,0.0027882701,0.74303836,0.009425551,0.0001806426,0.0006584056,0.00070384407,0.00080877444,0.054959644],"genre_scores_gemma":[0.83282083,0.00089898496,0.16214302,0.00058458524,0.00006446928,0.00088031247,0.0006017011,0.0001041884,0.0019019219],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9815564,0.014548246,0.0007475034,0.00090666243,0.0019094725,0.00033175232],"domain_scores_gemma":[0.92186975,0.067411885,0.0034876587,0.0039072684,0.0026639819,0.0006595179],"candidate_categories":["metaresearch","sts"],"consensus_categories":[],"category_scores_codex":[0.018928045,0.0010460534,0.00064119144,0.0070096245,0.0016792557,0.008276849,0.0019989717,0.0014912878,0.0035162503],"category_scores_gemma":[0.051726148,0.0005284066,0.0015368946,0.0046841963,0.00879581,0.018875673,0.004441214,0.0030181718,0.0005124098],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007643209,0.00006191702,0.00537095,0.00042126546,0.000053541396,0.00016565525,0.06093323,0.0058474764,0.00084569736,0.89466137,0.0012426306,0.030319788],"study_design_scores_gemma":[0.00007750921,0.00014820478,0.005984552,0.0008854738,0.00011478839,0.00060166727,0.048797097,0.0669827,0.0013801523,0.8188769,0.055988763,0.00016210251],"about_ca_topic_score_codex":0.004182518,"about_ca_topic_score_gemma":0.0025130874,"teacher_disagreement_score":0.99832076,"about_ca_system_score_codex":0.0053401245,"about_ca_system_score_gemma":0.0030942012,"threshold_uncertainty_score":0.100102305},"labels":[],"label_agreement":null},{"id":"W4410747314","doi":"10.1111/gean.70016","title":"Can Topic Modeling of Local Newspaper Texts Enhance Understanding of Neighborhood Effects on Health?","year":2025,"lang":"en","type":"article","venue":"Geographical Analysis","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Arts and Humanities Research Council; Department of Health and Social Care; National Institute for Health and Care Research; Canadian Institute of Steel Construction","keywords":"Newspaper; Computer science; Data science; Advertising; Business","score_opus":0.02365192138780933,"score_gpt":0.3520915653434699,"score_spread":0.3284396439556606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410747314","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.739183,0.0035037545,0.23706098,0.0037086764,0.00021767395,0.0003993055,0.0075986725,0.0014082356,0.0069197253],"genre_scores_gemma":[0.9540267,0.0006802309,0.04093119,0.00012297864,0.00018948127,0.00027353433,0.0028885491,0.00007425283,0.00081302604],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976292,0.0017062051,0.000114319184,0.0003688372,0.00010622379,0.00007529882],"domain_scores_gemma":[0.9595809,0.03724017,0.0013551881,0.00087723526,0.0007009247,0.00024571284],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0053584324,0.00061131525,0.0005669911,0.0037962676,0.00042222402,0.0028703858,0.00056267745,0.0006495797,0.003077174],"category_scores_gemma":[0.023197541,0.00031213515,0.0014089241,0.0027103608,0.00048692262,0.0023342674,0.00080483145,0.0008122497,0.0006517585],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001853849,0.00088533753,0.4381912,0.002712769,0.002223625,0.00077210204,0.020352397,0.100562416,0.010037725,0.027185109,0.012966257,0.38225728],"study_design_scores_gemma":[0.00009404118,0.0002631975,0.11789554,0.00036591326,0.00047052078,0.0002449822,0.005878157,0.829678,0.0017884547,0.03112906,0.012110833,0.000081227365],"about_ca_topic_score_codex":0.006531872,"about_ca_topic_score_gemma":0.0065579126,"teacher_disagreement_score":0.006531872,"about_ca_system_score_codex":0.00075749325,"about_ca_system_score_gemma":0.0005567691,"threshold_uncertainty_score":0.028338432},"labels":[],"label_agreement":null},{"id":"W4410870391","doi":"10.1007/s11002-025-09775-5","title":"Guidelines for creating content when conducting netnographic research","year":2025,"lang":"en","type":"article","venue":"Marketing Letters","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"King's College London","keywords":"Content (measure theory); Business; Computer science; Mathematics","score_opus":0.5950606538914234,"score_gpt":0.5405792596133916,"score_spread":0.05448139427803178,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410870391","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010501855,0.0014587197,0.7383101,0.018162888,0.00245241,0.111547396,0.0028081515,0.0054494184,0.10930906],"genre_scores_gemma":[0.014358173,0.00083627005,0.87632555,0.0021185577,0.0003987014,0.09086859,0.0008204852,0.0009792759,0.013294325],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.75032234,0.19720967,0.02665186,0.0038829248,0.019176578,0.0027566615],"domain_scores_gemma":[0.5244481,0.2773852,0.018992804,0.07858677,0.08905304,0.011534031],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.19127168,0.0017717785,0.0015583853,0.014380747,0.007341607,0.010800904,0.0058056135,0.0064867977,0.037491623],"category_scores_gemma":[0.34634274,0.0022692236,0.0016492083,0.0072174068,0.008100915,0.009101845,0.009397352,0.007162965,0.039167706],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007284225,0.0015034119,0.0033365914,0.0069102123,0.00005422804,0.0024822592,0.09727612,0.0010884684,0.017742567,0.11362847,0.19314449,0.5621048],"study_design_scores_gemma":[0.00024582387,0.00031374628,0.0027973144,0.010130448,0.000036908634,0.0009170183,0.02155207,0.0020037792,0.009456458,0.08099073,0.8713448,0.00021098016],"about_ca_topic_score_codex":0.0018634656,"about_ca_topic_score_gemma":0.007085997,"teacher_disagreement_score":0.19127168,"about_ca_system_score_codex":0.0035414784,"about_ca_system_score_gemma":0.018018343,"threshold_uncertainty_score":0.997306},"labels":[],"label_agreement":null},{"id":"W4410881487","doi":"10.37213/cjal.2024.33477","title":"Trends of replication studies in Applied Linguistics journals: A systematic review over half a century","year":2025,"lang":"en","type":"review","venue":"Canadian Journal of Applied Linguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Applied linguistics; Replication (statistics); Linguistics; Historical linguistics; Philosophy; Biology","score_opus":0.11939947433166546,"score_gpt":0.46161682404112614,"score_spread":0.34221734970946066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410881487","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002588895,0.99160296,0.0014210205,0.0024034658,0.00061234337,0.00034447454,0.00039338818,0.000028748345,0.0006046324],"genre_scores_gemma":[0.034245074,0.9525233,0.0075050755,0.0024981871,0.00060691073,0.001571739,0.00065603794,0.000080298116,0.00031336452],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.833169,0.07923898,0.049586326,0.010313475,0.0262281,0.0014640394],"domain_scores_gemma":[0.33590236,0.4853459,0.06282801,0.017743913,0.09575607,0.002423705],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.15579866,0.0011987244,0.005140255,0.03224531,0.0020771804,0.007489246,0.0027085776,0.0030281127,0.0024240725],"category_scores_gemma":[0.4486427,0.0020784885,0.004837226,0.04248052,0.0033222164,0.008853683,0.0036021755,0.0028185626,0.00072309235],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050303567,0.0000773324,0.013489695,0.5580115,0.0067537385,0.00037045355,0.007869184,0.00025746558,0.00074518897,0.0045848396,0.013598093,0.39373955],"study_design_scores_gemma":[0.00019158819,0.0003138973,0.021499977,0.7809668,0.014367358,0.0010518646,0.0065274434,0.00037562873,0.0010773101,0.003607281,0.16983068,0.00019015725],"about_ca_topic_score_codex":0.009808669,"about_ca_topic_score_gemma":0.020699969,"teacher_disagreement_score":0.9677547,"about_ca_system_score_codex":0.007652802,"about_ca_system_score_gemma":0.04029623,"threshold_uncertainty_score":0.8239519},"labels":[],"label_agreement":null},{"id":"W4410932950","doi":"10.1186/s13750-025-00362-9","title":"Evaluating generative AI for qualitative data extraction in community-based fisheries management literature","year":2025,"lang":"en","type":"article","venue":"Environmental Evidence","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Centre for Marine Socioecology; Canada Excellence Research Chairs, Government of Canada; Commonwealth Scientific and Industrial Research Organisation","keywords":"Context (archaeology); Computer science; Data science; Data extraction; Generative grammar; Systematic review; Knowledge management; Artificial intelligence; MEDLINE; Political science","score_opus":0.28783733455543326,"score_gpt":0.5558607988604336,"score_spread":0.26802346430500035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410932950","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21116127,0.021453086,0.6554652,0.010260668,0.00081982336,0.05954476,0.011215338,0.003479436,0.026600482],"genre_scores_gemma":[0.24209665,0.002169832,0.7121408,0.0013818031,0.00012849989,0.03802432,0.0030206116,0.00022048774,0.00081698847],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.6360156,0.29721802,0.035689477,0.00904758,0.020678379,0.0013508447],"domain_scores_gemma":[0.06586908,0.8702329,0.018983766,0.019502074,0.02460464,0.0008076228],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.36039132,0.0018024585,0.0022929027,0.027562875,0.0034283234,0.0116875125,0.0048246775,0.002090786,0.0071488684],"category_scores_gemma":[0.73554456,0.0015423608,0.0042225854,0.018878208,0.0039207092,0.008532258,0.010964101,0.002327324,0.0013222956],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002695132,0.0007408539,0.03489874,0.12895644,0.004062188,0.0013122604,0.14089648,0.0149334725,0.006390795,0.038151465,0.011397779,0.6155644],"study_design_scores_gemma":[0.005527645,0.004115047,0.058087375,0.112216674,0.010226398,0.0023446886,0.114821576,0.15658183,0.034683604,0.27744946,0.22211988,0.0018257841],"about_ca_topic_score_codex":0.0039142845,"about_ca_topic_score_gemma":0.010821929,"teacher_disagreement_score":0.6396087,"about_ca_system_score_codex":0.0076917587,"about_ca_system_score_gemma":0.018239278,"threshold_uncertainty_score":0.78875136},"labels":[],"label_agreement":null},{"id":"W4411120498","doi":"10.18653/v1/2025.in2writing-1.10","title":"An Analysis of Scoring Methods for Reranking in Large Language Model Story Generation","year":2025,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Natural language processing; Language model; Artificial intelligence","score_opus":0.07331420775418603,"score_gpt":0.5180781471380161,"score_spread":0.44476393938383013,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411120498","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02423437,0.0008397363,0.97035027,0.0002438855,0.000057008805,0.00024888694,0.00013511683,0.0020223532,0.0018684065],"genre_scores_gemma":[0.27372235,0.0004057307,0.72058994,0.00012361656,0.00009228797,0.0005368888,0.00079483766,0.00082313514,0.0029112115],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9845368,0.010475418,0.00073814834,0.0010400134,0.0029184117,0.00029128906],"domain_scores_gemma":[0.9071429,0.07407127,0.002823842,0.0067858123,0.008490926,0.00068521075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02143121,0.001493879,0.0010767078,0.002797948,0.0008285658,0.0017405653,0.002109219,0.0011441573,0.0036358952],"category_scores_gemma":[0.08147976,0.00053673715,0.0009244424,0.0019091626,0.000944274,0.0026209273,0.0015756291,0.002064463,0.0012957138],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039138302,0.000294608,0.0069493884,0.00048478498,0.00020135165,0.00009794397,0.00088709174,0.10754466,0.008128662,0.020564275,0.00714142,0.84731454],"study_design_scores_gemma":[0.000088354056,0.00020579858,0.0028629925,0.00006865303,0.000046036992,0.00013333383,0.0001435499,0.9688429,0.009500927,0.01388824,0.0041657607,0.000053456733],"about_ca_topic_score_codex":0.0031583405,"about_ca_topic_score_gemma":0.0065253796,"teacher_disagreement_score":0.02143121,"about_ca_system_score_codex":0.0012380559,"about_ca_system_score_gemma":0.001327079,"threshold_uncertainty_score":0.11334044},"labels":[],"label_agreement":null},{"id":"W4411120873","doi":"10.1609/icwsm.v19i1.35940","title":"UKTwitNewsCor: A Dataset of Online Local News Articles for the Study of Local News Provision","year":2025,"lang":"en","type":"article","venue":"Proceedings of the International AAAI Conference on Web and Social Media","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Surrey Place Centre","funders":"","keywords":"Political science","score_opus":0.07310951934286138,"score_gpt":0.38340480357340867,"score_spread":0.3102952842305473,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411120873","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030825423,0.00089007686,0.0018677079,0.0004893932,0.00018870039,0.00023808621,0.95525444,0.0012414056,0.009004766],"genre_scores_gemma":[0.017995667,0.00029584288,0.0044695255,0.000116296746,0.00006536883,0.00053627987,0.9725729,0.0001664802,0.0037816209],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986866,0.0002996938,0.0002085232,0.0003035254,0.0003424243,0.00015922477],"domain_scores_gemma":[0.99440056,0.0019287969,0.0008513831,0.00090273004,0.0014174638,0.0004990051],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007955484,0.00082741305,0.00072348246,0.008244905,0.0011262884,0.0019513245,0.0013153685,0.0016751767,0.011777854],"category_scores_gemma":[0.00881627,0.00036308434,0.0005910002,0.011387377,0.0005584235,0.002185051,0.0022938584,0.0008259108,0.01756155],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037315473,0.00021242733,0.029037142,0.0027978853,0.00011588553,0.0011007624,0.0023304475,0.0011001762,0.0027460335,0.0028751944,0.90914863,0.04816226],"study_design_scores_gemma":[0.00010495783,0.00008634188,0.060950194,0.0004062142,0.00007095675,0.00059293344,0.0027690153,0.003605511,0.0021305853,0.0012771577,0.92792344,0.00008268498],"about_ca_topic_score_codex":0.027615363,"about_ca_topic_score_gemma":0.076465935,"teacher_disagreement_score":0.027615363,"about_ca_system_score_codex":0.0012859355,"about_ca_system_score_gemma":0.0014444442,"threshold_uncertainty_score":0.05490923},"labels":[],"label_agreement":null},{"id":"W4411132606","doi":"10.34135/mlar-25-01-01","title":"An AI-Assisted Topic Model of the Media Literacy Research Literature","year":2025,"lang":"en","type":"article","venue":"Media Literacy and Academic Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Media literacy; Computer science; Literacy; Psychology; Pedagogy","score_opus":0.18122599853324503,"score_gpt":0.5620379082017904,"score_spread":0.3808119096685454,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411132606","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05132431,0.0024372935,0.9208143,0.0029370019,0.00040201674,0.00071281084,0.008551504,0.0023912715,0.010429535],"genre_scores_gemma":[0.5485347,0.0027130034,0.4068067,0.00046758982,0.0009952965,0.003756493,0.016487064,0.000388112,0.019851029],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980268,0.0008016983,0.00017586847,0.00053179066,0.00028953617,0.00017425625],"domain_scores_gemma":[0.9905379,0.007676641,0.00043445427,0.00036472056,0.00079048425,0.00019583509],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.004303303,0.0010257888,0.0009540601,0.007953454,0.0014148046,0.003976266,0.0025084263,0.0020740544,0.008170348],"category_scores_gemma":[0.012922065,0.0006252966,0.00263313,0.0071348934,0.0009900404,0.0032891114,0.0019574994,0.0019166196,0.0029573236],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008783416,0.0005008011,0.019903025,0.0013818293,0.00049120554,0.0006488404,0.003804926,0.41142148,0.004296013,0.19181359,0.027286133,0.33757377],"study_design_scores_gemma":[0.00006221635,0.000036649337,0.0013528906,0.00006693818,0.00006642112,0.00008850125,0.00021932447,0.93792975,0.00041056256,0.049232412,0.010509514,0.000024854555],"about_ca_topic_score_codex":0.016165411,"about_ca_topic_score_gemma":0.019017663,"teacher_disagreement_score":0.99204654,"about_ca_system_score_codex":0.002134749,"about_ca_system_score_gemma":0.002582907,"threshold_uncertainty_score":0.03214264},"labels":[],"label_agreement":null},{"id":"W4411170938","doi":"10.2196/72771","title":"Using Natural Language Processing to Describe the Use of an Online Community for Abortion During 2022: Dynamic Topic Modeling Analysis of Reddit Posts","year":2025,"lang":"en","type":"article","venue":"JMIR Infodemiology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Preprint; Abortion; Computer science; Data science; World Wide Web; Pregnancy; Biology","score_opus":0.20378749391147927,"score_gpt":0.5023566003933344,"score_spread":0.29856910648185514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411170938","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.895547,0.0010080683,0.073384434,0.0026603895,0.00012567862,0.00052836986,0.021295546,0.00068516616,0.0047654826],"genre_scores_gemma":[0.93673205,0.000299493,0.041765314,0.00016483391,0.00009845818,0.0006610167,0.018619174,0.00007129509,0.001588408],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99824727,0.00076781306,0.00017386659,0.00043704052,0.00021974268,0.00015426586],"domain_scores_gemma":[0.9781497,0.01895891,0.0014234353,0.00047552714,0.0007448157,0.00024764193],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003734063,0.0005508909,0.00036654223,0.005179413,0.000833882,0.0021354489,0.00084121677,0.0010223273,0.0013021207],"category_scores_gemma":[0.01273287,0.00026818787,0.0014100047,0.0038981151,0.0007010037,0.0023605565,0.0009744861,0.00137999,0.0006287262],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013985386,0.001200364,0.5572481,0.0015889127,0.00063406705,0.0027915263,0.03949957,0.08958655,0.014918462,0.021195397,0.026280884,0.24365763],"study_design_scores_gemma":[0.000054243494,0.00021726945,0.20550907,0.00023975364,0.00017096307,0.00071194035,0.018550886,0.72837204,0.003697565,0.014827029,0.02748446,0.00016489942],"about_ca_topic_score_codex":0.027817583,"about_ca_topic_score_gemma":0.036319166,"teacher_disagreement_score":0.027817583,"about_ca_system_score_codex":0.001991606,"about_ca_system_score_gemma":0.001196522,"threshold_uncertainty_score":0.055311322},"labels":[],"label_agreement":null},{"id":"W4411174920","doi":"10.1007/s11192-025-05339-6","title":"Mapping the unseen in practice: comparing latent Dirichlet allocation and BERTopic for navigating topic spaces","year":2025,"lang":"en","type":"article","venue":"Scientometrics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; Université de Montréal","funders":"Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung","keywords":"Latent Dirichlet allocation; Topic model; Computer science; Data science; Information retrieval","score_opus":0.1049383044834109,"score_gpt":0.4485186821781035,"score_spread":0.3435803776946926,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411174920","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.41224155,0.0055577066,0.57150096,0.0016430218,0.00023866302,0.00042429916,0.0011825707,0.002560852,0.0046503604],"genre_scores_gemma":[0.8682662,0.0010573622,0.12549417,0.00020052954,0.00014451386,0.0003351706,0.0025167074,0.0004617503,0.0015236705],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9877117,0.009398458,0.00048399967,0.0014251552,0.00069394085,0.00028668033],"domain_scores_gemma":[0.8546899,0.13393337,0.00162218,0.0062689087,0.0022120457,0.0012736242],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.02142833,0.0014393444,0.0017325198,0.007230429,0.0016025673,0.004057971,0.0028614916,0.003307279,0.0029589662],"category_scores_gemma":[0.13334651,0.00070001965,0.0017334495,0.0036154394,0.0021141225,0.01245547,0.006525296,0.003588392,0.000978166],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009958333,0.0018274148,0.042964756,0.002833538,0.0019642364,0.00015268505,0.006855904,0.3216303,0.0026498027,0.0412706,0.007914989,0.5599775],"study_design_scores_gemma":[0.00020951379,0.00046517342,0.004302834,0.0001277809,0.00021908726,0.00007269226,0.001143955,0.9307411,0.0011032101,0.06000768,0.001516865,0.000090140755],"about_ca_topic_score_codex":0.014494122,"about_ca_topic_score_gemma":0.012546308,"teacher_disagreement_score":0.9927696,"about_ca_system_score_codex":0.0021529817,"about_ca_system_score_gemma":0.0022471072,"threshold_uncertainty_score":0.11332518},"labels":[{"model":"gemma","categories":["bibliometrics"],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W4411398301","doi":"10.18280/ijsse.150409","title":"Prediction of Violence Against Women Using Ensemble Learning Models: A Comparative Study of LightGBM, XGBoost, and Others","year":2025,"lang":"en","type":"article","venue":"International Journal of Safety and Security Engineering","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Binus University","keywords":"Ensemble learning; Computer science; Poison control; Artificial intelligence; Machine learning; Psychology; Medical emergency; Medicine","score_opus":0.04127146386870915,"score_gpt":0.3240864878929002,"score_spread":0.282815024024191,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411398301","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8328185,0.015913593,0.14026079,0.0019907334,0.00090805907,0.00023180373,0.0009711525,0.0016624106,0.0052429535],"genre_scores_gemma":[0.96437776,0.0019792584,0.03040603,0.00029661466,0.00013569432,0.00008932024,0.0011934708,0.00004968292,0.001472203],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991923,0.0003169674,0.000055285767,0.0001497418,0.00016401515,0.000121744335],"domain_scores_gemma":[0.9982887,0.00095676293,0.00011306115,0.0001014311,0.00043856844,0.00010153602],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031185404,0.0014070696,0.0019902117,0.0017709277,0.00054273487,0.0008618027,0.0012584111,0.0010899258,0.0005634178],"category_scores_gemma":[0.0033426876,0.00029756443,0.0012627166,0.0013110989,0.00026808665,0.000890116,0.0005658883,0.0011706003,0.00019609493],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00079773116,0.0006602839,0.03870627,0.00026848237,0.0007232848,0.00012344989,0.00012199711,0.7075752,0.0009194149,0.0007443227,0.004626326,0.24473326],"study_design_scores_gemma":[0.000009543362,0.00011216238,0.002855205,0.000027522665,0.000053706022,0.000016932743,0.0000441566,0.995939,0.0003099278,0.00027010686,0.00035378613,0.000007972941],"about_ca_topic_score_codex":0.025340885,"about_ca_topic_score_gemma":0.017118277,"teacher_disagreement_score":0.025340885,"about_ca_system_score_codex":0.0009271831,"about_ca_system_score_gemma":0.0010856878,"threshold_uncertainty_score":0.050386786},"labels":[],"label_agreement":null},{"id":"W4412055803","doi":"10.1145/3719160.3735657","title":"DeTAILS: Deep Thematic Analysis with Iterative LLM Support","year":2025,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Thematic map; Thematic analysis; Artificial intelligence; Sociology; Qualitative research","score_opus":0.02041839590602907,"score_gpt":0.3783361953984013,"score_spread":0.35791779949237224,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412055803","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030551045,0.00014093785,0.7808071,0.00095357676,0.00047983322,0.00078206114,0.044853605,0.1556765,0.013251248],"genre_scores_gemma":[0.02657461,0.00009092271,0.8996712,0.0004247865,0.00010125291,0.0016678737,0.030358534,0.02296287,0.018148001],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9979572,0.00050223735,0.0002405394,0.0005412991,0.00052268716,0.00023589213],"domain_scores_gemma":[0.9929508,0.003131253,0.0002165856,0.0020043438,0.001389236,0.0003078936],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0032935305,0.001948125,0.0012353961,0.0024223423,0.0015220229,0.004019604,0.0034806908,0.0019479721,0.31953052],"category_scores_gemma":[0.028349938,0.0013749937,0.0031502964,0.0021437134,0.0007010224,0.0042527085,0.0040969164,0.0029800027,0.15907192],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049659575,0.00017765744,0.002246847,0.0010465038,0.00020157025,0.0002076598,0.001128841,0.004461373,0.01050041,0.02089541,0.46924666,0.48939043],"study_design_scores_gemma":[0.00058796274,0.00009557682,0.003098534,0.00038757743,0.00018418855,0.00042456208,0.0013341132,0.19322172,0.037352834,0.196763,0.5662875,0.00026241885],"about_ca_topic_score_codex":0.005528313,"about_ca_topic_score_gemma":0.012590852,"teacher_disagreement_score":0.31953052,"about_ca_system_score_codex":0.0010029494,"about_ca_system_score_gemma":0.0032672954,"threshold_uncertainty_score":0.97060716},"labels":[],"label_agreement":null},{"id":"W4412146717","doi":"10.59490/dgo.2025.1068","title":"Leveraging AI Models for Automated Pattern Detection in Citizen Participation Data","year":2025,"lang":"en","type":"article","venue":"Conference on Digital Government Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Université du Québec à Rimouski","funders":"","keywords":"Computer science; Citizen science; Data science; Artificial intelligence","score_opus":0.36580161139820266,"score_gpt":0.5243350730544242,"score_spread":0.1585334616562215,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412146717","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07031407,0.0006640079,0.91183853,0.0038001856,0.00014640181,0.0005169247,0.001496412,0.002586441,0.008637077],"genre_scores_gemma":[0.5938941,0.0006352268,0.39468756,0.00086056493,0.00021159278,0.0006904745,0.00335276,0.00019008777,0.0054775514],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9972855,0.0010509245,0.00020600617,0.0006684875,0.0006266374,0.00016238872],"domain_scores_gemma":[0.98153746,0.014623315,0.0010331608,0.00096851244,0.0016171173,0.00022033826],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041313935,0.0008238983,0.0007450808,0.0039013063,0.0008359123,0.003334304,0.0015719659,0.0011170311,0.0027234307],"category_scores_gemma":[0.021409307,0.00039345122,0.0014214396,0.0030026452,0.0010254972,0.0042555546,0.0013332963,0.002038626,0.001371946],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038672728,0.0010037267,0.04661302,0.0005831511,0.00040361463,0.00048058352,0.0017152845,0.4172862,0.0052854996,0.050453328,0.013128214,0.46266073],"study_design_scores_gemma":[0.0000059986423,0.000023270732,0.0011084966,0.00002354109,0.000013228294,0.00003491146,0.00010905114,0.9757996,0.0004720267,0.020602513,0.0017972115,0.000010130063],"about_ca_topic_score_codex":0.012269402,"about_ca_topic_score_gemma":0.016868377,"teacher_disagreement_score":0.012269402,"about_ca_system_score_codex":0.0017815467,"about_ca_system_score_gemma":0.0018765231,"threshold_uncertainty_score":0.024396002},"labels":[],"label_agreement":null},{"id":"W4412373306","doi":"10.56553/popets-2025-0122","title":"An Analysis of Chinese Censorship Bias in LLMs","year":2025,"lang":"en","type":"article","venue":"Proceedings on Privacy Enhancing Technologies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Censorship; Psychology; Political science; Law","score_opus":0.044322569085843096,"score_gpt":0.3945897658567422,"score_spread":0.3502671967708991,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412373306","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9545249,0.0008252443,0.037202004,0.0007657211,0.00009782935,0.00017370567,0.0012061485,0.0012883282,0.003916019],"genre_scores_gemma":[0.990346,0.00009077598,0.0070041833,0.00011741573,0.000030948897,0.000073590774,0.0012204829,0.00008647181,0.0010301331],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9926409,0.0035300103,0.0006076111,0.0012842882,0.0015567502,0.0003803724],"domain_scores_gemma":[0.905142,0.07473359,0.005572887,0.008169832,0.005481313,0.00090043794],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018189548,0.00082904985,0.00068442046,0.0019700525,0.0010471526,0.0017698077,0.001223587,0.0009708332,0.0021544881],"category_scores_gemma":[0.07300234,0.00029869055,0.000849986,0.001709368,0.0016827423,0.0029845864,0.0018075858,0.0018670202,0.0006443021],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0033042303,0.00048410211,0.42506662,0.0010515779,0.0007065483,0.0012494317,0.008327714,0.18344244,0.01431963,0.01798137,0.012956432,0.33110997],"study_design_scores_gemma":[0.00009834359,0.00053706917,0.10512452,0.00014922209,0.00021103982,0.0004297291,0.0012458808,0.8562815,0.020393655,0.009236204,0.006137346,0.00015543775],"about_ca_topic_score_codex":0.016416239,"about_ca_topic_score_gemma":0.013112019,"teacher_disagreement_score":0.018189548,"about_ca_system_score_codex":0.002898565,"about_ca_system_score_gemma":0.0015497914,"threshold_uncertainty_score":0.09619671},"labels":[],"label_agreement":null},{"id":"W4412411851","doi":"10.31603/bishss.91","title":"Analysis of public awareness on global warming: Forecasting using Google Trends and FB prophet","year":2024,"lang":"en","type":"article","venue":"BIS Humanities and Social Science","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Global warming; Environmental science; Meteorology; Geography; Climatology; Climate change; Oceanography","score_opus":0.2787081734752284,"score_gpt":0.4233060014606646,"score_spread":0.1445978279854362,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412411851","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9662081,0.0014761693,0.0047543454,0.001144865,0.00017318041,0.00010303293,0.018212365,0.0007004963,0.007227335],"genre_scores_gemma":[0.9734683,0.0007664291,0.004413956,0.00007731865,0.0000965189,0.000054107615,0.019373551,0.000046293582,0.001703474],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988502,0.00022987257,0.00011987308,0.00021086288,0.00046449047,0.00012465102],"domain_scores_gemma":[0.9928726,0.0038238948,0.0010415004,0.0005942586,0.0014355935,0.00023215832],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019622443,0.00090742,0.0007215828,0.0070539326,0.00036009535,0.0013257614,0.0005860502,0.0010018488,0.0010562973],"category_scores_gemma":[0.011096868,0.0002329219,0.0013594894,0.006297211,0.00035810756,0.0025276272,0.00048332312,0.0011208967,0.00116983],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00069313415,0.0005018763,0.77751046,0.000762095,0.0004730223,0.00077504985,0.0009167301,0.065357104,0.0021440904,0.002913564,0.019195395,0.12875752],"study_design_scores_gemma":[0.000025194586,0.00035365546,0.4087749,0.0001350808,0.00014675767,0.0004569498,0.00150915,0.57476515,0.0020450829,0.0020676027,0.009623498,0.000096917305],"about_ca_topic_score_codex":0.036536276,"about_ca_topic_score_gemma":0.025730869,"teacher_disagreement_score":0.036536276,"about_ca_system_score_codex":0.001036769,"about_ca_system_score_gemma":0.0006369146,"threshold_uncertainty_score":0.072647214},"labels":[],"label_agreement":null},{"id":"W4412462026","doi":"10.1017/dap.2025.10005","title":"Tracing institutional change in the officer corps using textual data from a military school: promise, pitfalls, and ethical considerations","year":2025,"lang":"en","type":"article","venue":"Data & Policy","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Department of National Defence","funders":"","keywords":"Officer; Tracing; Engineering ethics; Political science; Engineering; Law; Computer science","score_opus":0.3016082156529764,"score_gpt":0.48867566291136905,"score_spread":0.18706744725839264,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412462026","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4969438,0.002696009,0.3232541,0.11483642,0.0015569858,0.0041229837,0.009224613,0.00033873122,0.04702629],"genre_scores_gemma":[0.72986,0.0012061199,0.24356246,0.007269046,0.0007308583,0.0074481037,0.0021508138,0.00015853519,0.007614103],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.8865889,0.093953125,0.0044755475,0.0038562133,0.01005068,0.0010756121],"domain_scores_gemma":[0.5767351,0.27547398,0.02882242,0.06859795,0.046400685,0.0039698454],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13623461,0.00056093285,0.0005626576,0.006482432,0.0048924116,0.008198205,0.0035695692,0.0027922129,0.0033581739],"category_scores_gemma":[0.26943332,0.00056135963,0.00052627514,0.010075347,0.007872807,0.0101470845,0.0048813415,0.0038903775,0.0012124556],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004729892,0.0007129953,0.25590035,0.0019459231,0.00026548133,0.0011931908,0.20087385,0.0026937712,0.005304687,0.19689606,0.034354545,0.29938605],"study_design_scores_gemma":[0.00010101367,0.00050232455,0.14810538,0.009720132,0.0002243782,0.0012302969,0.29355982,0.034945834,0.013601331,0.2514217,0.24615917,0.0004286715],"about_ca_topic_score_codex":0.008057134,"about_ca_topic_score_gemma":0.016915048,"teacher_disagreement_score":0.13623461,"about_ca_system_score_codex":0.0028144938,"about_ca_system_score_gemma":0.0051661846,"threshold_uncertainty_score":0.7204861},"labels":[],"label_agreement":null},{"id":"W4412568039","doi":"10.1109/ichi64645.2025.00032","title":"Privacy Preservation Embedding-Based Clustering for Population Stratification Using Large Language Models","year":2025,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"Natural Sciences and Engineering Research Council of Canada; Mitacs","keywords":"Cluster analysis; Computer science; Embedding; Stratification (seeds); Population stratification; Data mining; Artificial intelligence","score_opus":0.09104518065992609,"score_gpt":0.45240247977895387,"score_spread":0.3613572991190278,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412568039","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.034751542,0.0002115365,0.9625036,0.00068645953,0.000034968773,0.0000610585,0.00025497613,0.00059867674,0.00089722837],"genre_scores_gemma":[0.7586,0.000364733,0.23662567,0.00043146274,0.00008969385,0.00020353953,0.00094328506,0.00016197762,0.0025796872],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99507093,0.0025563745,0.00029662426,0.0008518372,0.0009195206,0.00030469033],"domain_scores_gemma":[0.9859511,0.0076040085,0.001012207,0.0043951273,0.00079757336,0.00023991475],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047453865,0.00080507575,0.0009583164,0.00087605894,0.0010186412,0.0018918107,0.0013138457,0.0012425144,0.0013413306],"category_scores_gemma":[0.02177014,0.00046418427,0.0012066604,0.0011450355,0.0019415203,0.0045563662,0.0038833087,0.0024774866,0.00062434113],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005971425,0.00022561889,0.007271907,0.00023384058,0.0002181807,0.0005609634,0.0011508553,0.534754,0.010876851,0.22207838,0.005845914,0.21618637],"study_design_scores_gemma":[0.000017379327,0.00004913389,0.00032060227,0.00001101202,0.000016452204,0.00014573865,0.00007175509,0.89222527,0.0035098004,0.10246119,0.001150789,0.000020854935],"about_ca_topic_score_codex":0.0017974644,"about_ca_topic_score_gemma":0.0019658334,"teacher_disagreement_score":0.0047453865,"about_ca_system_score_codex":0.0011827699,"about_ca_system_score_gemma":0.0016775834,"threshold_uncertainty_score":0.025096238},"labels":[],"label_agreement":null},{"id":"W4412662201","doi":"10.51408/issi2025_127","title":"Old but Not Obsolete: Bag-of-Words vs. Embeddings in Topic Modeling","year":2025,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Association Nationale de la Recherche et de la Technologie; Canada Research Chairs","keywords":"Computer science; Natural language processing; Artificial intelligence","score_opus":0.04076485449645448,"score_gpt":0.38907516835753725,"score_spread":0.3483103138610828,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412662201","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19631773,0.008443917,0.7849021,0.0028571696,0.00024366836,0.00012371733,0.0011743577,0.001460058,0.004477351],"genre_scores_gemma":[0.77751887,0.0017023222,0.2166673,0.00035785034,0.00034286274,0.00016610746,0.001711114,0.00039004892,0.0011435703],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9954501,0.003005792,0.00028107007,0.0006259538,0.0005085466,0.00012852823],"domain_scores_gemma":[0.98082477,0.014938705,0.00084723206,0.0018779677,0.0011787447,0.00033254837],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009302029,0.00081562746,0.0006569292,0.0028722659,0.0005812595,0.0035872106,0.00068164454,0.0010189343,0.0011363048],"category_scores_gemma":[0.0365625,0.0003284659,0.0007796717,0.003569654,0.0011389549,0.00800385,0.0019994979,0.0024097243,0.0007346513],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013829385,0.00023361894,0.038376328,0.0009858666,0.00057196454,0.00013358016,0.0031628136,0.060383435,0.0069372524,0.073889755,0.010101023,0.8038415],"study_design_scores_gemma":[0.000087525674,0.0005193914,0.012720132,0.00043057514,0.00023700115,0.00040231907,0.0013792886,0.7084526,0.0069700587,0.25481018,0.013833361,0.0001575976],"about_ca_topic_score_codex":0.0022679328,"about_ca_topic_score_gemma":0.004080393,"teacher_disagreement_score":0.009302029,"about_ca_system_score_codex":0.0006981545,"about_ca_system_score_gemma":0.0007620331,"threshold_uncertainty_score":0.049194455},"labels":[],"label_agreement":null},{"id":"W4412698753","doi":"10.1177/08944393251361457","title":"Artificial Intelligence and the Social Scientist: The Mediation of AIfied Creative Sites","year":2025,"lang":"en","type":"article","venue":"Social Science Computer Review","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institut National de la Recherche Scientifique","funders":"","keywords":"Mediation; Sociology; Media studies; Psychology; Social science","score_opus":0.08603291275738766,"score_gpt":0.45354347772487497,"score_spread":0.3675105649674873,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412698753","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14721142,0.12699229,0.111941926,0.16752742,0.0018851912,0.00035307292,0.00013742315,0.00034321865,0.4436081],"genre_scores_gemma":[0.96125215,0.020192131,0.009491832,0.002855643,0.0005823678,0.00021366289,0.00002975367,0.00008141065,0.005301083],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9624184,0.03189797,0.0005671229,0.0014090465,0.0027426889,0.0009647933],"domain_scores_gemma":[0.94575566,0.045464568,0.0028021303,0.003203646,0.0015252472,0.0012487241],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.02420351,0.00060036324,0.0008492291,0.0054849475,0.0059999684,0.016975075,0.0022030126,0.003604264,0.0052043567],"category_scores_gemma":[0.028948208,0.0005243991,0.0006544022,0.003591815,0.04863126,0.019782607,0.012011543,0.0038551546,0.0005988197],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003471207,0.00005761133,0.0018474233,0.00053931825,0.00007496828,0.0006096857,0.093010366,0.0004482131,0.00037494508,0.86547583,0.002246219,0.035280745],"study_design_scores_gemma":[0.00005437397,0.00007207978,0.002156563,0.001275308,0.00006665369,0.00047942027,0.05584707,0.0012707922,0.00047209108,0.7623046,0.1759446,0.000056412766],"about_ca_topic_score_codex":0.0030313549,"about_ca_topic_score_gemma":0.0033387423,"teacher_disagreement_score":0.994,"about_ca_system_score_codex":0.0050306018,"about_ca_system_score_gemma":0.007592244,"threshold_uncertainty_score":0.12800193},"labels":[],"label_agreement":null},{"id":"W4412758291","doi":"10.2139/ssrn.5371748","title":"Media Stars: Statistical Significance and Research Impact","year":2025,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University; Wilfrid Laurier University; University of Ottawa","funders":"","keywords":"Stars; Astronomy; Psychology; Physics","score_opus":0.04380645921953111,"score_gpt":0.4695292865772686,"score_spread":0.4257228273577375,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412758291","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.68200046,0.03929585,0.11917964,0.049135998,0.01201034,0.001457934,0.024722528,0.0018302232,0.070367016],"genre_scores_gemma":[0.97636807,0.0016849713,0.010583168,0.0015077259,0.003083426,0.00045160486,0.0026814716,0.0003417782,0.0032977457],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.8868871,0.06505776,0.009227136,0.014066802,0.021274704,0.0034865765],"domain_scores_gemma":[0.2549307,0.6620659,0.028765908,0.024780424,0.01810809,0.011348988],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.10467861,0.001315651,0.002704644,0.021220062,0.0027915372,0.011947806,0.0027619451,0.003258857,0.026880844],"category_scores_gemma":[0.5127787,0.00058287807,0.004914683,0.028519979,0.009331553,0.0108466735,0.007047199,0.0049347132,0.0023901456],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004627906,0.0005873678,0.780447,0.0023456227,0.013031784,0.0010224093,0.0034016373,0.0013012696,0.00095290935,0.035649527,0.030044392,0.12658827],"study_design_scores_gemma":[0.001765532,0.0033835794,0.5743283,0.0020310455,0.024689239,0.0025941199,0.014662334,0.024021547,0.0043083387,0.2992122,0.04858759,0.0004162009],"about_ca_topic_score_codex":0.0023383086,"about_ca_topic_score_gemma":0.0020536077,"teacher_disagreement_score":0.9787799,"about_ca_system_score_codex":0.0015959343,"about_ca_system_score_gemma":0.005214261,"threshold_uncertainty_score":0.5536},"labels":[],"label_agreement":null},{"id":"W4413009343","doi":"10.1016/j.dib.2025.111960","title":"A large-scale dataset of AI-related tweets: Structure and descriptive statistics","year":2025,"lang":"en","type":"article","venue":"Data in Brief","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal; Polytechnique Montréal","funders":"Fonds de recherche du Québec – Nature et technologies; Polytechnique Montréal","keywords":"Descriptive statistics; Scale (ratio); Computer science; Statistics; Data science; Information retrieval; Geography; Mathematics; Cartography","score_opus":0.030684713059905035,"score_gpt":0.38076412225030537,"score_spread":0.3500794091904003,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413009343","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059716858,0.00022740936,0.0044286977,0.0007923202,0.00017401927,0.0006294745,0.9288901,0.00072523864,0.00441582],"genre_scores_gemma":[0.05308977,0.00017252886,0.011251802,0.00020344304,0.00013464282,0.001984045,0.93088686,0.00019504751,0.0020817663],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9965521,0.00089870376,0.0005711493,0.0005930812,0.0010877061,0.00029717264],"domain_scores_gemma":[0.9847356,0.0074041304,0.0018406782,0.0022389796,0.0031991,0.00058152195],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0023141406,0.0006042787,0.0006126308,0.0064933244,0.0012121144,0.0014667133,0.0010222679,0.0013288537,0.0057585537],"category_scores_gemma":[0.017458133,0.00028522193,0.0004952347,0.009935255,0.000670958,0.0013279787,0.0021066803,0.0011788798,0.008741107],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00096779113,0.00080784824,0.119201414,0.0031362355,0.0002470004,0.0012617309,0.0054255016,0.0050381618,0.011007007,0.00900636,0.74955803,0.09434294],"study_design_scores_gemma":[0.00021302601,0.00027042866,0.29017544,0.00059484807,0.00011672729,0.0010220472,0.0071578813,0.014050511,0.0063354354,0.0073230704,0.67249906,0.00024149785],"about_ca_topic_score_codex":0.009254249,"about_ca_topic_score_gemma":0.015051045,"teacher_disagreement_score":0.99350667,"about_ca_system_score_codex":0.0012707969,"about_ca_system_score_gemma":0.0023417226,"threshold_uncertainty_score":0.01926428},"labels":[],"label_agreement":null},{"id":"W4413143276","doi":"10.1016/j.laheal.2025.100064","title":"Linguistic insights into dementia from 1994 to 2023: A structural topic modeling-assisted bibliometric analysis","year":2025,"lang":"en","type":"article","venue":"Language and Health","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Social Science Foundation of Jiangsu Province","keywords":"Dementia; Linguistics; Psychology; Medicine; Philosophy","score_opus":0.046566592701892395,"score_gpt":0.44086269256624594,"score_spread":0.39429609986435354,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413143276","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8661594,0.06114968,0.0055158464,0.0034708064,0.00022478375,0.00056129176,0.048445653,0.0003267113,0.014145846],"genre_scores_gemma":[0.95690435,0.0145925,0.0066345553,0.00011263866,0.00027094872,0.000349469,0.02026703,0.000036722504,0.0008318093],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9908242,0.002335717,0.0022390436,0.0008075091,0.003352031,0.00044158348],"domain_scores_gemma":[0.94987077,0.027830366,0.012206505,0.0011697711,0.008007166,0.0009154896],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.009532408,0.00064574153,0.0012817748,0.17297655,0.001355321,0.004885269,0.0007300594,0.0006992026,0.001997413],"category_scores_gemma":[0.046159316,0.00025809105,0.0021099537,0.19259329,0.00082926,0.0031784745,0.0022243042,0.0005828156,0.00047140464],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004393038,0.0001630561,0.7388801,0.008179799,0.0022607578,0.0011439419,0.007572685,0.004393445,0.0012928178,0.0047624605,0.010770241,0.22014135],"study_design_scores_gemma":[0.00004256697,0.00021780646,0.92946815,0.0019722667,0.0016266726,0.0013563131,0.010828079,0.009575492,0.0009246421,0.0038679552,0.040009856,0.00011022452],"about_ca_topic_score_codex":0.014023642,"about_ca_topic_score_gemma":0.01942487,"teacher_disagreement_score":0.82702345,"about_ca_system_score_codex":0.0035255437,"about_ca_system_score_gemma":0.0048095835,"threshold_uncertainty_score":0.050412774},"labels":[],"label_agreement":null},{"id":"W4413197088","doi":"10.1080/10447318.2025.2542902","title":"Exploring the Role of AI Anchor Image-News Content Congruency in News-Viewing Experience Among Gen Zers: A Mixed-Method Study in the Chinese Context","year":2025,"lang":"en","type":"article","venue":"International Journal of Human-Computer Interaction","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute on Governance","funders":"","keywords":"Advertising; Context (archaeology); Psychology; Content (measure theory); Computer science; Business; History; Mathematics","score_opus":0.09293163762656322,"score_gpt":0.44351516420522585,"score_spread":0.35058352657866265,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413197088","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99939835,0.000021131154,0.00021175588,0.000013738717,0.0000022112283,0.000042802894,0.000027439688,0.0000015525002,0.00028088377],"genre_scores_gemma":[0.998628,0.000031276602,0.0005444653,0.000027335302,0.0000035048229,0.0001441172,0.000055914985,0.000003338067,0.0005621641],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99910456,0.00031937513,0.000075263095,0.0002059205,0.000129101,0.0001657478],"domain_scores_gemma":[0.997387,0.0014071908,0.0004396247,0.00024339028,0.00035113003,0.00017165375],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020316136,0.00045179014,0.0006043844,0.0008364888,0.0012972542,0.0011152889,0.00034761097,0.0004286062,0.0036023755],"category_scores_gemma":[0.004457702,0.00024824688,0.00050721,0.000715869,0.0009929584,0.0007922261,0.0007608265,0.00044116986,0.0003007339],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019843192,0.0019508689,0.49282366,0.0010351406,0.00022452915,0.0015067649,0.41815838,0.0003553421,0.027351385,0.0017821231,0.0005620854,0.05226537],"study_design_scores_gemma":[0.00011561546,0.0019643488,0.77075297,0.00011537445,0.0002632642,0.00027454362,0.21537837,0.0018860714,0.0049147024,0.0009942416,0.00323524,0.00010526446],"about_ca_topic_score_codex":0.0061160848,"about_ca_topic_score_gemma":0.011513917,"teacher_disagreement_score":0.0061160848,"about_ca_system_score_codex":0.0007602166,"about_ca_system_score_gemma":0.0009554329,"threshold_uncertainty_score":0.012160957},"labels":[],"label_agreement":null},{"id":"W4413213892","doi":"10.3998/mij.7628","title":"Augmenting Content Analysis in the Era of Streaming Video: Harnessing AI for Comprehensive VoD Research","year":2025,"lang":"en","type":"article","venue":"Media Industries","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Collège Jean-de-Brébeuf; Université du Québec à Montréal","funders":"","keywords":"Scope (computer science); Computer science; Multimedia; Studio; Video on demand; Generative grammar; Content analysis; Video streaming; Production (economics); Interactive media; Artificial intelligence; Sociology; Telecommunications","score_opus":0.33010715843890803,"score_gpt":0.48580154061560304,"score_spread":0.155694382176695,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413213892","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.179131,0.0038393007,0.72584826,0.011204566,0.000298583,0.0007283566,0.0014359073,0.0011555827,0.076358475],"genre_scores_gemma":[0.5809154,0.002382268,0.40815085,0.0007918479,0.0002300385,0.0005962638,0.0011145163,0.0004321801,0.005386712],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99181855,0.0057798955,0.00029469258,0.00071563054,0.0012010684,0.00019021957],"domain_scores_gemma":[0.94329876,0.04775164,0.0016379696,0.0046671066,0.0022245154,0.00042005422],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011347862,0.00059551175,0.00048050465,0.009360103,0.0018008112,0.00912133,0.0014872603,0.0010903006,0.0046054455],"category_scores_gemma":[0.04348756,0.0003430445,0.0006621567,0.006569659,0.00663533,0.013344326,0.00510053,0.001682921,0.0008026307],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017032228,0.00020803373,0.017660016,0.0015788964,0.00014029742,0.00058235606,0.07948264,0.007485509,0.008971434,0.3234386,0.006364558,0.5539172],"study_design_scores_gemma":[0.000050232793,0.00015042062,0.015604875,0.0015704038,0.00012592264,0.0005971029,0.067750216,0.0842818,0.011608877,0.6548863,0.1632244,0.00014941297],"about_ca_topic_score_codex":0.0031135841,"about_ca_topic_score_gemma":0.004857927,"teacher_disagreement_score":0.011347862,"about_ca_system_score_codex":0.0030276794,"about_ca_system_score_gemma":0.0023759764,"threshold_uncertainty_score":0.06001395},"labels":[],"label_agreement":null},{"id":"W4413333183","doi":"10.1016/j.nlp.2025.100176","title":"Analyzing social media discourse of avian influenza outbreaks","year":2025,"lang":"en","type":"article","venue":"Natural Language Processing Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"Ontario Ministry of Agriculture, Food and Rural Affairs; University of Guelph","keywords":"Outbreak; Influenza A virus subtype H5N1; Social media; Virology; Sociology; Geography; Biology; Computer science; Virus; World Wide Web","score_opus":0.021597179736304994,"score_gpt":0.4121351556805344,"score_spread":0.3905379759442294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413333183","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9960188,0.0001603228,0.0005681107,0.00026952993,0.000026262862,0.000027531121,0.0007362933,0.000024212164,0.0021689283],"genre_scores_gemma":[0.9965295,0.00021084036,0.0012130988,0.00007467347,0.00008062371,0.000046658308,0.0009183151,0.0000135987,0.0009125344],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9992142,0.00040603045,0.000059324673,0.00009584635,0.0001635929,0.00006106483],"domain_scores_gemma":[0.99314606,0.0049647707,0.001002467,0.00018232461,0.0005592376,0.00014509926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014766537,0.00030345793,0.00016578757,0.0017640936,0.00053592614,0.0012098829,0.00019375776,0.000449673,0.0010786195],"category_scores_gemma":[0.0067747612,0.000112074005,0.00020147426,0.0011322465,0.00038387283,0.0013735258,0.0010192522,0.00043479752,0.00033272922],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016980518,0.0005017766,0.54786617,0.0016454315,0.00020148764,0.0020183316,0.1836533,0.0027275854,0.061034158,0.0031252182,0.009176907,0.1863516],"study_design_scores_gemma":[0.000029506911,0.0004638095,0.7813728,0.0004955926,0.0001550518,0.00060736795,0.12387629,0.037765045,0.014802378,0.0015448165,0.03877194,0.0001153627],"about_ca_topic_score_codex":0.00448674,"about_ca_topic_score_gemma":0.005743947,"teacher_disagreement_score":0.00448674,"about_ca_system_score_codex":0.0005556446,"about_ca_system_score_gemma":0.0002898708,"threshold_uncertainty_score":0.008921266},"labels":[],"label_agreement":null},{"id":"W4413484588","doi":"10.1101/2025.08.21.25334182","title":"A Simulation Study to Advance Human-Centred Artificial Intelligence via Digital Citizen Science: Can Large Language Models Transform Current Approaches to Missing Data Imputation?","year":2025,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Imputation (statistics); Missing data; Computer science; Artificial intelligence; Data science; Current (fluid); Machine learning; Data mining; Engineering; Electrical engineering","score_opus":0.2879845659338913,"score_gpt":0.4615149857511824,"score_spread":0.17353041981729106,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413484588","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8551546,0.0006099754,0.13131309,0.0034499073,0.00015535402,0.00087789056,0.002032218,0.00030506376,0.0061019915],"genre_scores_gemma":[0.9400965,0.00018953322,0.056508906,0.0004464384,0.00004171811,0.00088482647,0.0009266825,0.000034502184,0.00087090465],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9891193,0.009339542,0.00025596216,0.0006299579,0.00032017427,0.00033507164],"domain_scores_gemma":[0.792639,0.19275066,0.004140713,0.005319828,0.0039225323,0.0012272288],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.022892412,0.00080164656,0.0009939086,0.0009416748,0.000857859,0.0018299852,0.0023234466,0.0024109937,0.004280328],"category_scores_gemma":[0.08840274,0.00046748552,0.0017141855,0.0014304299,0.0014659781,0.0020368805,0.0021449102,0.0032080729,0.00038456472],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013914403,0.0009307029,0.03452819,0.00044883782,0.00031542405,0.00037977187,0.0013050681,0.91287667,0.00037607367,0.03026311,0.002474325,0.014710377],"study_design_scores_gemma":[0.00028479233,0.00035566432,0.0015936136,0.00009996885,0.000060124974,0.000041486564,0.000456421,0.9837714,0.00037022022,0.011932127,0.00100477,0.00002938532],"about_ca_topic_score_codex":0.015641732,"about_ca_topic_score_gemma":0.01326843,"teacher_disagreement_score":0.9771076,"about_ca_system_score_codex":0.0023000916,"about_ca_system_score_gemma":0.002305747,"threshold_uncertainty_score":0.12106812},"labels":[],"label_agreement":null},{"id":"W4413592086","doi":"10.64628/aam.ndddpjv5e","title":"Canadians are relocating for jobs amid steep inflation and low unemployment","year":2022,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Unemployment; Inflation (cosmology); Economics; Labour economics; Keynesian economics; Demographic economics; Macroeconomics","score_opus":0.05402207349361692,"score_gpt":0.3752813949281094,"score_spread":0.3212593214344925,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413592086","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8794163,0.0011606473,0.0008579977,0.043578863,0.00052648905,0.000069771384,0.005959201,0.00011745015,0.06831322],"genre_scores_gemma":[0.9779278,0.00060112384,0.0007376457,0.0023430523,0.00007327951,0.000013186004,0.0013836729,0.000024725128,0.016895454],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9990717,0.00007202399,0.000012391214,0.00008496203,0.00023118936,0.0005276723],"domain_scores_gemma":[0.9977545,0.00019965679,0.00032707272,0.00005765182,0.00069115154,0.00096997863],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006543351,0.00020140588,0.00039670183,0.00085545797,0.00941943,0.0031729133,0.0007214091,0.0012215566,0.01325738],"category_scores_gemma":[0.004111567,0.00018110304,0.00042063216,0.0031818664,0.0012082465,0.00080352055,0.0009860557,0.0017762546,0.0010196111],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008673028,0.00021083187,0.60851353,0.00025127153,0.00018414739,0.0011655923,0.014500617,0.0022379789,0.0012131981,0.026874304,0.2508506,0.09313062],"study_design_scores_gemma":[0.00008851602,0.00007981662,0.6997842,0.00016625221,0.00014834914,0.00028113314,0.12918022,0.00320075,0.00048409635,0.007533903,0.15892328,0.00012951538],"about_ca_topic_score_codex":0.9877202,"about_ca_topic_score_gemma":0.9952726,"teacher_disagreement_score":0.014964704,"about_ca_system_score_codex":0.014964704,"about_ca_system_score_gemma":0.034413148,"threshold_uncertainty_score":0.10857707},"labels":[],"label_agreement":null},{"id":"W4413750761","doi":"10.2196/78682","title":"Extension of the Consolidated Criteria for Reporting Qualitative Research Guideline to Large Language Models (COREQ+LLM): Protocol for a Multiphase Study","year":2025,"lang":"en","type":"article","venue":"JMIR Research Protocols","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Preprint; Guideline; Protocol (science); Qualitative research; Computer science; Psychology; Medicine; Alternative medicine; World Wide Web; Sociology","score_opus":0.7942757918621323,"score_gpt":0.7988086140447332,"score_spread":0.004532822182600982,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413750761","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006367589,0.00017728457,0.013742828,0.000621921,0.00033870075,0.98039836,0.0031253798,0.00025135968,0.0007073709],"genre_scores_gemma":[0.000326736,0.000049699498,0.010421521,0.000099092096,0.0000107511505,0.9887199,0.00022351992,0.000014872812,0.00013390127],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.78357065,0.15626048,0.03483429,0.009314484,0.011532172,0.004487931],"domain_scores_gemma":[0.72447574,0.13364232,0.025724616,0.039811138,0.06987073,0.006475459],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24478638,0.0054750172,0.0074798865,0.009028859,0.007496724,0.007401476,0.0068175076,0.008035715,0.080261216],"category_scores_gemma":[0.29681742,0.0069027757,0.007332678,0.009682029,0.0061689713,0.00843248,0.008245451,0.013257922,0.022858912],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.02223802,0.0033878444,0.0034767864,0.16057904,0.0011651064,0.0018359149,0.05528792,0.0077778646,0.0068923933,0.059856188,0.3834542,0.29404876],"study_design_scores_gemma":[0.04612497,0.0043127644,0.009447249,0.1113996,0.00085264735,0.0009243918,0.018833749,0.012910591,0.009159902,0.09121624,0.6932312,0.0015866514],"about_ca_topic_score_codex":0.0048678285,"about_ca_topic_score_gemma":0.0074470043,"teacher_disagreement_score":0.7552136,"about_ca_system_score_codex":0.012110159,"about_ca_system_score_gemma":0.06787748,"threshold_uncertainty_score":0.93131286},"labels":[],"label_agreement":null},{"id":"W4413907963","doi":"10.1080/13876988.2025.2543984","title":"AI in a Comparative Perspective: Linking Policy Formulation and Implementation","year":2025,"lang":"en","type":"article","venue":"Journal of Comparative Policy Analysis Research and Practice","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Perspective (graphical); Sociology; Epistemology; Regional science; Political science; Positive economics; Economics; Computer science; Philosophy; Artificial intelligence","score_opus":0.24416974320248055,"score_gpt":0.6763017617811761,"score_spread":0.43213201857869554,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413907963","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23357445,0.01863018,0.068133384,0.06917074,0.000541519,0.0002235162,0.00056833547,0.0001085789,0.6090493],"genre_scores_gemma":[0.9853131,0.003623359,0.0086198505,0.0005555973,0.00008433874,0.0001510046,0.000144661,0.000021327895,0.0014867826],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.967062,0.027213866,0.0008269288,0.0016139355,0.0020848147,0.0011984842],"domain_scores_gemma":[0.964461,0.027024925,0.0025937166,0.0020166768,0.0032165118,0.0006872596],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.021118857,0.00044572246,0.000677323,0.008652653,0.0038508903,0.009831113,0.0014890537,0.002220561,0.007387707],"category_scores_gemma":[0.049347457,0.0002567253,0.00033588381,0.012345033,0.01242083,0.0127033405,0.004675669,0.0021976985,0.000321718],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004059875,0.000036251364,0.0044213915,0.00020951776,0.000037424652,0.000045526926,0.0076697976,0.0019406538,0.000074629956,0.9540877,0.0010105356,0.030426055],"study_design_scores_gemma":[0.000041649466,0.0002311225,0.026285427,0.0020463327,0.00010770779,0.0001462213,0.07988683,0.008593529,0.0007662544,0.7535807,0.1282575,0.00005665234],"about_ca_topic_score_codex":0.009811239,"about_ca_topic_score_gemma":0.00833941,"teacher_disagreement_score":0.9961491,"about_ca_system_score_codex":0.015402625,"about_ca_system_score_gemma":0.009140659,"threshold_uncertainty_score":0.11175436},"labels":[],"label_agreement":null},{"id":"W4413964668","doi":"10.31234/osf.io/qz9mu_v1","title":"Prosodic cues strengthen human-AI voice boundaries: Listeners do not easily perceive human speakers and AI clones as the same person","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"China Scholarship Council; National Natural Science Foundation of China; McGill University","keywords":"Psychology; Speech recognition; Linguistics; Communication; Computer science; Cognitive psychology","score_opus":0.06147413222118589,"score_gpt":0.401451533152134,"score_spread":0.3399774009309481,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413964668","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9905839,0.00009562057,0.005823344,0.000050335384,0.000012165526,0.000011574719,0.0000398807,0.00009554483,0.0032876146],"genre_scores_gemma":[0.9966725,0.000038744427,0.002717889,0.000063045445,0.000009015125,0.000014035875,0.00008458599,0.000033853485,0.0003662703],"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","domain_scores_codex":[0.99935204,0.00014940582,0.00005020219,0.00020421023,0.00018342753,0.00006069647],"domain_scores_gemma":[0.9962274,0.0023564196,0.00047323047,0.00042603802,0.00028541422,0.00023148996],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010288708,0.00037132492,0.0002676979,0.00026861674,0.00024535475,0.001070022,0.00025188853,0.00043098332,0.0031366379],"category_scores_gemma":[0.009637926,0.00026447352,0.00019471526,0.0001449012,0.000519006,0.0014078477,0.0014484733,0.0006378535,0.00043878242],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011251535,0.000105258136,0.046350412,0.000297316,0.00007272858,0.00026275328,0.0037761491,0.00087744865,0.8767566,0.0008816376,0.00039691062,0.06909764],"study_design_scores_gemma":[0.00006949762,0.0022911022,0.77003866,0.00010574963,0.00016533908,0.0018407223,0.0044287876,0.014255301,0.19796139,0.0034427007,0.0052710907,0.00012965738],"about_ca_topic_score_codex":0.00058179547,"about_ca_topic_score_gemma":0.000741272,"teacher_disagreement_score":0.0031366379,"about_ca_system_score_codex":0.00014649805,"about_ca_system_score_gemma":0.0001580192,"threshold_uncertainty_score":0.0104931},"labels":[],"label_agreement":null},{"id":"W4414078729","doi":"10.1016/j.cont.2025.102240","title":"316 - Urinary incontinence discussions on Instagram: A hashtag analysis of top posts and reels","year":2025,"lang":"en","type":"article","venue":"Continence","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Urinary incontinence; MEDLINE; Data collection; Ogden","score_opus":0.01945703524315106,"score_gpt":0.3790784860976585,"score_spread":0.3596214508545074,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414078729","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98811495,0.00012558405,0.00095238315,0.00024898007,0.00003930936,0.00020868894,0.004281686,0.00007238226,0.0059558847],"genre_scores_gemma":[0.9873613,0.00018306659,0.003664228,0.00020021644,0.000050610626,0.00055004214,0.0037334864,0.00007794336,0.004179024],"study_design_codex":"observational","study_design_gemma":"qualitative","domain_scores_codex":[0.99894553,0.0003513539,0.00011688793,0.000109028035,0.00025073256,0.00022637544],"domain_scores_gemma":[0.99310136,0.003369014,0.0017864752,0.00034139532,0.001073284,0.00032849988],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013018226,0.0002603393,0.00027337507,0.0028584744,0.000641352,0.001697446,0.00035495727,0.0003811431,0.005180558],"category_scores_gemma":[0.009915247,0.00016528249,0.0002701431,0.0031041661,0.0005072617,0.0016386313,0.0017420523,0.00043223574,0.0019087447],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011935148,0.00021899452,0.7042514,0.0017371526,0.00007248922,0.0011685853,0.12676536,0.00024338865,0.010715987,0.002420774,0.014828642,0.13638368],"study_design_scores_gemma":[0.000012946557,0.00022580718,0.87589324,0.0003319758,0.00006159621,0.0005747258,0.08854284,0.0014440733,0.0024863544,0.0005650228,0.029806975,0.00005448371],"about_ca_topic_score_codex":0.0037408096,"about_ca_topic_score_gemma":0.0075456267,"teacher_disagreement_score":0.005180558,"about_ca_system_score_codex":0.0005702002,"about_ca_system_score_gemma":0.0006022769,"threshold_uncertainty_score":0.017330706},"labels":[],"label_agreement":null},{"id":"W4414693363","doi":"10.1109/tts.2025.3611984","title":"Using Large Language Models in Cluster Analysis in the Social Sciences","year":2025,"lang":"en","type":"article","venue":"IEEE Transactions on Technology and Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute on Governance","funders":"","keywords":"Cluster analysis; Metadata; Workflow; Context (archaeology); Variety (cybernetics); Exploratory data analysis; Thematic map; Topic model; Language model","score_opus":0.04261437470856897,"score_gpt":0.4023507107515543,"score_spread":0.3597363360429853,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414693363","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051675397,0.00018929664,0.9920541,0.00072745245,0.000050933388,0.00015671915,0.00031145426,0.00081551576,0.0005268932],"genre_scores_gemma":[0.11602119,0.00027378032,0.87909967,0.00037219492,0.00014323184,0.0013115613,0.0013497766,0.00048875064,0.00093992025],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9744922,0.01986177,0.00091523444,0.00263307,0.0017255024,0.0003722157],"domain_scores_gemma":[0.94342643,0.04747707,0.0017738107,0.004407293,0.0024391792,0.00047623232],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022794997,0.0017420034,0.0014809868,0.006527554,0.002910902,0.006107543,0.0035032674,0.0019602785,0.002270716],"category_scores_gemma":[0.07492498,0.0010194246,0.0035455597,0.0075536445,0.003515502,0.004580143,0.005417616,0.003797052,0.0013648914],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035928676,0.00037799758,0.01643511,0.00084323715,0.001387479,0.00045895527,0.006850435,0.44523442,0.0027557076,0.27339584,0.013303799,0.23859778],"study_design_scores_gemma":[0.000030724295,0.000030950916,0.0011795614,0.000078201156,0.000045382192,0.00004675468,0.0007126988,0.74445933,0.0008117354,0.24779126,0.004739593,0.000073788135],"about_ca_topic_score_codex":0.020906933,"about_ca_topic_score_gemma":0.029011542,"teacher_disagreement_score":0.022794997,"about_ca_system_score_codex":0.0042419233,"about_ca_system_score_gemma":0.005754108,"threshold_uncertainty_score":0.1205529},"labels":[],"label_agreement":null},{"id":"W4414818091","doi":"10.1109/ase63991.2025.00012","title":"MIMIC: Integrating Diverse Personality Traits for Better Game Testing Using Large Language Model","year":2025,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds de recherche du Québec","keywords":"Imitation; Task (project management); Big Five personality traits; Video game; Personality; Neglect","score_opus":0.12888672975465792,"score_gpt":0.44351776409391513,"score_spread":0.3146310343392572,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414818091","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22926298,0.00059114746,0.74922264,0.0009796789,0.00013690894,0.00043959668,0.00080750295,0.01446971,0.0040899566],"genre_scores_gemma":[0.71508604,0.00013149281,0.28010094,0.00040333005,0.00004133578,0.00032607836,0.0010963646,0.00042403294,0.0023903933],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984717,0.0007937543,0.00007723408,0.00032548408,0.00023086616,0.000100928584],"domain_scores_gemma":[0.9960751,0.002614533,0.00024399196,0.00059628626,0.00026432716,0.00020572984],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023134097,0.0009876009,0.00070160854,0.0010516223,0.000400584,0.0010046288,0.0013064414,0.0008461137,0.0016955611],"category_scores_gemma":[0.010485216,0.00042710366,0.00073262485,0.00039445414,0.00074753875,0.002463176,0.001405583,0.0012321566,0.0005762604],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008253107,0.0013926508,0.04797641,0.0004932775,0.00044915357,0.0007304582,0.0010262146,0.35944608,0.031628653,0.017691357,0.016737577,0.5216028],"study_design_scores_gemma":[0.00003316732,0.00011298574,0.0013297279,0.000008463552,0.000018717657,0.000087693974,0.00005020018,0.989027,0.0021687264,0.0057096197,0.0014330634,0.000020688703],"about_ca_topic_score_codex":0.0041355626,"about_ca_topic_score_gemma":0.008917834,"teacher_disagreement_score":0.0041355626,"about_ca_system_score_codex":0.0005874643,"about_ca_system_score_gemma":0.0010341095,"threshold_uncertainty_score":0.012234628},"labels":[],"label_agreement":null},{"id":"W4414952275","doi":"10.1111/psj.70079","title":"A Natural Language Processing Approach to Identifying Partisan Framing of Climate Change Denialism, Fatalism, and Solutions in <scp>US</scp> Congressional Speeches","year":2025,"lang":"en","type":"article","venue":"Policy Studies Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Vrije Universiteit Amsterdam","keywords":"Framing (construction); Climate change; Politics; Fatalism; Political economy of climate change; Public discourse; Discourse analysis","score_opus":0.12560559029339052,"score_gpt":0.4678262183855526,"score_spread":0.3422206280921621,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414952275","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8708424,0.0004562232,0.10955575,0.002633735,0.00010491638,0.000311242,0.0036125607,0.0004131706,0.012069924],"genre_scores_gemma":[0.94915295,0.000117899326,0.047423214,0.00009505178,0.00005029234,0.00022720403,0.0020120533,0.00003856732,0.00088276214],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9977514,0.0014407381,0.00014849615,0.00035626962,0.00020913134,0.00009402819],"domain_scores_gemma":[0.9841276,0.012271608,0.0016361496,0.0005652864,0.0011922612,0.00020711983],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003277285,0.00030956633,0.00022786943,0.005668599,0.001062938,0.0029471854,0.00034355177,0.0004944345,0.0031408689],"category_scores_gemma":[0.014350042,0.00025405514,0.0005050763,0.0032524974,0.0011756636,0.0023306701,0.0014282941,0.0012232361,0.0005025711],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009283712,0.0008891288,0.22265032,0.0010422237,0.00039850894,0.0010563389,0.07811321,0.016550247,0.037131447,0.06796199,0.0105388025,0.56273943],"study_design_scores_gemma":[0.000077755954,0.00026778184,0.4034465,0.00040514252,0.00022366318,0.00057243987,0.06785146,0.38491952,0.016664274,0.08187945,0.0434559,0.00023613177],"about_ca_topic_score_codex":0.009494803,"about_ca_topic_score_gemma":0.011832384,"teacher_disagreement_score":0.009494803,"about_ca_system_score_codex":0.0014524644,"about_ca_system_score_gemma":0.0011834403,"threshold_uncertainty_score":0.018879116},"labels":[],"label_agreement":null},{"id":"W4415009153","doi":"10.36227/techrxiv.176003146.66290582/v1","title":"A Hybrid Retrieval-Augmented Generation and Language Model Framework for Evidence-Grounded Review Systems","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Language model; Key (lock); Modeling language; Field (mathematics); Natural language","score_opus":0.17542773321767788,"score_gpt":0.46813434914942254,"score_spread":0.29270661593174463,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415009153","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011365403,0.00043285757,0.9946084,0.00081071985,0.0000451078,0.0003285892,0.00023228844,0.0013820012,0.001023502],"genre_scores_gemma":[0.076203786,0.0003816887,0.91971385,0.0004767896,0.00010022127,0.000801649,0.0007529438,0.00030442575,0.0012646106],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9633478,0.02581825,0.0024164594,0.0032589848,0.0047129076,0.00044565095],"domain_scores_gemma":[0.9167546,0.06038322,0.0034946124,0.0108123245,0.007723908,0.00083135907],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038729306,0.0014081622,0.0019131147,0.0053766365,0.0013186396,0.0069573424,0.0042330665,0.003101504,0.007408065],"category_scores_gemma":[0.11300484,0.0013174189,0.0033491007,0.003028248,0.0029685772,0.0064178417,0.00722686,0.0028899056,0.0029280626],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004939223,0.00021411951,0.0024825498,0.0026495496,0.0006933956,0.00087285263,0.0034097533,0.18901825,0.005858773,0.3629919,0.00973604,0.42157894],"study_design_scores_gemma":[0.00020209416,0.00016891002,0.00037516523,0.00045321326,0.00025289913,0.00032871874,0.00022894319,0.5431876,0.0038477432,0.42133445,0.02949478,0.00012543364],"about_ca_topic_score_codex":0.0059518814,"about_ca_topic_score_gemma":0.0069718957,"teacher_disagreement_score":0.038729306,"about_ca_system_score_codex":0.0032225056,"about_ca_system_score_gemma":0.0071594287,"threshold_uncertainty_score":0.2048226},"labels":[],"label_agreement":null},{"id":"W4415089370","doi":"10.1080/02699931.2025.2568551","title":"Affective connotations according to LLMs: implications for meaning measurement and cultural bias","year":2025,"lang":"en","type":"article","venue":"Cognition & Emotion","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Agence Nationale de la Recherche; Deutsche Forschungsgemeinschaft","keywords":"Meaning (existential); Scholarship; German; Generative grammar; Dimension (graph theory); Connotation; Social influence; Test (biology)","score_opus":0.20707377952530648,"score_gpt":0.4406527657466264,"score_spread":0.2335789862213199,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415089370","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.83017164,0.00078786863,0.13989727,0.0017679265,0.00012844747,0.00039837344,0.0006553699,0.00039081016,0.025802275],"genre_scores_gemma":[0.97771066,0.00008504546,0.021215118,0.0001733267,0.000024569172,0.0002657581,0.0001693959,0.000058631835,0.00029746187],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9674566,0.0239365,0.0021458925,0.0023438695,0.0036598872,0.00045728573],"domain_scores_gemma":[0.77170277,0.16580571,0.018879676,0.028249724,0.013603155,0.0017589292],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043817587,0.0007413094,0.0006042701,0.0028957922,0.0010226965,0.005136121,0.00091635826,0.00071632286,0.00345289],"category_scores_gemma":[0.26970294,0.00040562425,0.0010154045,0.0026798346,0.005698951,0.0052741244,0.004675838,0.0015803244,0.0005236319],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011748722,0.00029995348,0.4455952,0.0014888059,0.0008892453,0.0002741752,0.18280314,0.0069177225,0.019724086,0.118276104,0.0025507,0.2200059],"study_design_scores_gemma":[0.00019647919,0.00064800266,0.4716963,0.001329255,0.0004441433,0.0006717092,0.061140064,0.09012093,0.01667818,0.33832258,0.018138096,0.0006142777],"about_ca_topic_score_codex":0.0025933501,"about_ca_topic_score_gemma":0.0026215108,"teacher_disagreement_score":0.043817587,"about_ca_system_score_codex":0.0018134709,"about_ca_system_score_gemma":0.0008547112,"threshold_uncertainty_score":0.23173237},"labels":[],"label_agreement":null},{"id":"W4415116292","doi":"10.1007/978-3-031-98157-9_5","title":"A Detailed Guide to Structural Topic Modelling in Educational Research: Insights from a Study on the Ethical Use of AI in Academia","year":2025,"lang":"en","type":"book-chapter","venue":"Ethics and integrity in educational contexts","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Taxonomy (biology); Graduate students; Ethical issues; Data collection; Replicate; Topic model","score_opus":0.3808960012783571,"score_gpt":0.5245446384649631,"score_spread":0.14364863718660603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415116292","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032403213,0.030206745,0.36391708,0.016683536,0.0015341897,0.0017731822,0.012099371,0.0031791995,0.5673664],"genre_scores_gemma":[0.018330008,0.03026231,0.5076119,0.004188363,0.0004219987,0.0028569917,0.0071898503,0.002521095,0.4266175],"study_design_codex":"not_applicable","study_design_gemma":"qualitative","domain_scores_codex":[0.9992213,0.00039143927,0.00007316107,0.00006506534,0.00020983048,0.000039117862],"domain_scores_gemma":[0.9945234,0.004677642,0.000073529925,0.0001506035,0.00045666206,0.00011815369],"candidate_categories":["metaresearch","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.0019452216,0.00088504096,0.00066573627,0.0026594691,0.0015973989,0.0037820642,0.0015613729,0.0021367844,0.08590442],"category_scores_gemma":[0.00578579,0.0008227842,0.00053712656,0.004631698,0.001530963,0.005105023,0.0013581825,0.0029695865,0.03612196],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000013696676,0.00012075206,0.0003144188,0.00091240543,0.000009470903,0.00023586977,0.005219657,0.0011661361,0.0007646336,0.25162357,0.49113262,0.24848683],"study_design_scores_gemma":[0.000004886071,0.000012016106,0.0003664206,0.00048288892,0.0000035198489,0.00029765558,0.0010776275,0.0007382643,0.00021855053,0.08500947,0.9117705,0.0000181361],"about_ca_topic_score_codex":0.008058598,"about_ca_topic_score_gemma":0.03141632,"teacher_disagreement_score":0.9980548,"about_ca_system_score_codex":0.0020145252,"about_ca_system_score_gemma":0.0039946567,"threshold_uncertainty_score":0.2873789},"labels":[],"label_agreement":null},{"id":"W4415152271","doi":"10.48550/arxiv.2504.08777","title":"The Lyme Disease Controversy: An AI-Driven Discourse Analysis of a Quarter Century of Academic Debate and Divides","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Lyme disease; Discourse analysis; Quarter (Canadian coin); Disease; Empirical research; Tracking (education)","score_opus":0.04210149341066817,"score_gpt":0.4040317285481901,"score_spread":0.3619302351375219,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415152271","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6949459,0.016797312,0.12467299,0.10325022,0.001182067,0.00057245337,0.0022178146,0.00045655546,0.055904724],"genre_scores_gemma":[0.9616597,0.0028049776,0.029217713,0.002066831,0.00040220874,0.00033767117,0.0007363644,0.00017739183,0.0025971667],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.94949627,0.039762426,0.0017971137,0.003050442,0.005307855,0.0005858935],"domain_scores_gemma":[0.7139006,0.2630797,0.0077999164,0.006866503,0.00666703,0.0016862463],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.06705442,0.0006470682,0.00082382635,0.014231956,0.008311803,0.016502379,0.0020586788,0.0032325396,0.002450221],"category_scores_gemma":[0.13120691,0.00049725943,0.0006816052,0.011154533,0.022314671,0.02110137,0.010356973,0.0034256882,0.00037809685],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015852641,0.000057633235,0.0069644535,0.0011309152,0.000070556096,0.00049936096,0.6407894,0.0015003068,0.0019831304,0.2772277,0.0057302923,0.0638877],"study_design_scores_gemma":[0.000044120738,0.00006816735,0.007537124,0.0022544323,0.000086052845,0.00039622455,0.43919492,0.012447981,0.0024718652,0.317457,0.21791886,0.00012323023],"about_ca_topic_score_codex":0.002912638,"about_ca_topic_score_gemma":0.002379604,"teacher_disagreement_score":0.9916882,"about_ca_system_score_codex":0.009635108,"about_ca_system_score_gemma":0.007665414,"threshold_uncertainty_score":0.3546219},"labels":[],"label_agreement":null},{"id":"W4415159347","doi":"10.48550/arxiv.2504.10004","title":"An Image is Worth $K$ Topics: A Visual Structural Topic Model with Pretrained Image Embeddings","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Freie Universität Berlin; Forskningsrådet om Hälsa, Arbetsliv och Välfärd; Vetenskapsrådet; York University","keywords":"Representation (politics); Toolbox; Image (mathematics); Topic model; Politics; Computational model; Sketch","score_opus":0.039923588682079326,"score_gpt":0.4058565986922922,"score_spread":0.36593301001021283,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415159347","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2221649,0.0022274537,0.7614032,0.0032338896,0.00034256096,0.00016860469,0.0022468085,0.0014455003,0.0067671267],"genre_scores_gemma":[0.9250248,0.00081949047,0.06390324,0.00043426725,0.0003602098,0.00021196896,0.0022435673,0.00022852306,0.006773892],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995864,0.0001299917,0.000014642809,0.00017448145,0.00004054129,0.000053935975],"domain_scores_gemma":[0.99864775,0.00085853867,0.00014272901,0.00016599399,0.000118274045,0.0000667463],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010801001,0.0006840494,0.0005467753,0.0010228178,0.00031816968,0.0013825216,0.0012169859,0.0014031288,0.0031377547],"category_scores_gemma":[0.0046429494,0.00048799318,0.0010862781,0.0010142036,0.00090390095,0.0029242937,0.0011867982,0.002095135,0.0010830985],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013260562,0.0005167686,0.015289913,0.0005985561,0.00038197634,0.00041987354,0.0019442715,0.28146476,0.017671028,0.10582512,0.03034162,0.54422003],"study_design_scores_gemma":[0.000024971809,0.00005661137,0.0021080629,0.000033816832,0.000041331823,0.000112233,0.00010119275,0.9528918,0.0010511664,0.040930234,0.002628514,0.000020016025],"about_ca_topic_score_codex":0.004339851,"about_ca_topic_score_gemma":0.0056585316,"teacher_disagreement_score":0.004339851,"about_ca_system_score_codex":0.0008353091,"about_ca_system_score_gemma":0.00041277433,"threshold_uncertainty_score":0.010496855},"labels":[],"label_agreement":null},{"id":"W4415230426","doi":"10.1609/aies.v8i2.36630","title":"An Audit and Analysis of LLM-Assisted Health Misinformation Jailbreaks Against LLMs","year":2025,"lang":"en","type":"article","venue":"Proceedings of the AAAI/ACM Conference on AI Ethics and Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Misinformation; Audit; SWORD; Work (physics); Custodians","score_opus":0.07402108718209562,"score_gpt":0.4200926547853142,"score_spread":0.3460715676032186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415230426","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9180598,0.0010337444,0.03193368,0.0049381545,0.00061338575,0.0007923586,0.0043323287,0.026039233,0.012257261],"genre_scores_gemma":[0.9752974,0.00018796368,0.017903464,0.000983504,0.000081780214,0.00013249982,0.0024050372,0.0005553455,0.0024530722],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9740723,0.014200042,0.0014428586,0.0015710116,0.007938772,0.0007750616],"domain_scores_gemma":[0.8545576,0.091286525,0.009446297,0.028623926,0.01418383,0.0019018529],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015269794,0.00082423235,0.0006117495,0.0024269845,0.0010715924,0.0018450534,0.0011989012,0.0018397227,0.0015362706],"category_scores_gemma":[0.08959872,0.00043193734,0.0004387255,0.0013903342,0.0015304106,0.0025210453,0.002457065,0.0025301797,0.0014082065],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0084257815,0.0029832202,0.22426309,0.0028501942,0.0007265586,0.0058871126,0.017992012,0.045583073,0.08979525,0.018055718,0.11359469,0.46984327],"study_design_scores_gemma":[0.00049110415,0.0032861994,0.124008484,0.0007636118,0.0002935137,0.0033441293,0.006293289,0.65135956,0.116062164,0.011067107,0.08259851,0.00043242687],"about_ca_topic_score_codex":0.0026382455,"about_ca_topic_score_gemma":0.0025300533,"teacher_disagreement_score":0.015269794,"about_ca_system_score_codex":0.0014540448,"about_ca_system_score_gemma":0.0013814897,"threshold_uncertainty_score":0.08075541},"labels":[],"label_agreement":null},{"id":"W4415686098","doi":"10.1007/978-3-031-95365-1_9","title":"The Use of Natural Language Processing in Learning Analytics","year":2025,"lang":"en","type":"book-chapter","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Learning analytics; Context (archaeology); Information extraction; Sentiment analysis; Analytics; Natural language understanding; Educational data mining","score_opus":0.06797414726166208,"score_gpt":0.3814139389179367,"score_spread":0.3134397916562746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415686098","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031621885,0.032083623,0.7916098,0.009457942,0.001591632,0.00018922568,0.0010149257,0.003549649,0.15734094],"genre_scores_gemma":[0.059155796,0.044571143,0.8186219,0.0040583466,0.0026114366,0.0005656428,0.002437425,0.0019873772,0.065990984],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99783677,0.000980931,0.00012951961,0.00032315784,0.00069315,0.000036461264],"domain_scores_gemma":[0.9892769,0.009505153,0.00014943288,0.0005037539,0.00049530185,0.00006946584],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002759442,0.00074109196,0.00044700684,0.0029422056,0.00054259726,0.0054832227,0.0009934637,0.0008057507,0.0106381485],"category_scores_gemma":[0.0069485353,0.00036499643,0.0007935812,0.003262775,0.0024132025,0.0054635718,0.0015457532,0.0023574682,0.005811873],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022580249,0.000040136805,0.0004571108,0.0014868418,0.000053096872,0.0002093058,0.0010693538,0.0035696034,0.0028614104,0.30723304,0.07294268,0.6100548],"study_design_scores_gemma":[0.000007102927,0.000024103118,0.0006319991,0.0010527427,0.000017690274,0.00036886914,0.00030231796,0.020129666,0.0030709591,0.35677162,0.61758095,0.00004205194],"about_ca_topic_score_codex":0.00094933645,"about_ca_topic_score_gemma":0.00096753985,"teacher_disagreement_score":0.0106381485,"about_ca_system_score_codex":0.0010005482,"about_ca_system_score_gemma":0.0009362427,"threshold_uncertainty_score":0.035588145},"labels":[],"label_agreement":null},{"id":"W4415695398","doi":"10.1080/23736992.2025.2583349","title":"Not a Revolution: How Artificial Intelligence is Augmenting Existing Political Communication Trends","year":2025,"lang":"en","type":"article","venue":"Journal of Media Ethics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Trois-Rivières","funders":"","keywords":"Politics; Key (lock); Field (mathematics); Government (linguistics)","score_opus":0.32188663001297146,"score_gpt":0.5034412366058896,"score_spread":0.1815546065929181,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415695398","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11151794,0.017745366,0.089544915,0.30021602,0.0039985375,0.00017268788,0.00051248784,0.0007874068,0.47550455],"genre_scores_gemma":[0.9119541,0.01072598,0.03611286,0.015243443,0.0036245056,0.00021503546,0.00036056133,0.0007755335,0.020987988],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9793285,0.01387884,0.0005834025,0.0018769315,0.003393845,0.0009384053],"domain_scores_gemma":[0.929244,0.05288804,0.0038569074,0.008036085,0.0040566707,0.0019182195],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02312893,0.0007143881,0.0006214929,0.00535643,0.00565084,0.0203489,0.0021020821,0.0038172652,0.01007921],"category_scores_gemma":[0.055392977,0.00054744846,0.0006409862,0.0044717435,0.022531174,0.038519587,0.0073431255,0.0057998616,0.0028366796],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010503902,0.00007800197,0.005449756,0.00041255605,0.000060567978,0.00028445185,0.03714207,0.0011910788,0.00095158163,0.82482743,0.014459695,0.115037754],"study_design_scores_gemma":[0.000028364868,0.00005596798,0.0028008327,0.0005917221,0.00003141505,0.00023573314,0.019938823,0.0031931517,0.00067903445,0.680364,0.2920177,0.000063231244],"about_ca_topic_score_codex":0.0020959037,"about_ca_topic_score_gemma":0.0024165027,"teacher_disagreement_score":0.02312893,"about_ca_system_score_codex":0.0032114964,"about_ca_system_score_gemma":0.00346602,"threshold_uncertainty_score":0.12231892},"labels":[],"label_agreement":null},{"id":"W4415779721","doi":"10.33423/jabe.v27i5.7857","title":"Approaching Human-Level Data Coding? A Systematic Comparison of OpenAI, DeepSeek, and Human Coders in Qualitative Analysis of Customer Reviews","year":2025,"lang":"","type":"article","venue":"Journal of Applied Business and Economics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Coding (social sciences); Qualitative analysis; Qualitative research; Scalability; Qualitative property","score_opus":0.24361101773523378,"score_gpt":0.47101974059486007,"score_spread":0.2274087228596263,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415779721","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27604324,0.02064671,0.64043,0.014015334,0.00229757,0.027954254,0.0025877235,0.0009178552,0.01510735],"genre_scores_gemma":[0.6172096,0.0027952679,0.32224634,0.003987224,0.0002296331,0.050568428,0.0010413877,0.0006089383,0.0013132073],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.21885204,0.66567534,0.05098808,0.017580293,0.044669356,0.0022349018],"domain_scores_gemma":[0.10275996,0.7069666,0.050013077,0.04572116,0.09292778,0.0016114914],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5500536,0.001530321,0.002662034,0.011248336,0.0045188507,0.0074254056,0.0034742134,0.0019498076,0.002288057],"category_scores_gemma":[0.77110386,0.0017461984,0.0019975405,0.010250842,0.013131112,0.009420106,0.011097219,0.0032434945,0.0007153244],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015159437,0.00029571945,0.064511836,0.042205527,0.002479845,0.0003591186,0.48241654,0.0017724513,0.007087642,0.029475618,0.010268662,0.3576112],"study_design_scores_gemma":[0.0020275696,0.0027051838,0.09289512,0.12530622,0.0031712612,0.0011977874,0.40333757,0.024110593,0.025042733,0.15945049,0.15922903,0.0015264958],"about_ca_topic_score_codex":0.0066999146,"about_ca_topic_score_gemma":0.014855273,"teacher_disagreement_score":0.4499464,"about_ca_system_score_codex":0.009274106,"about_ca_system_score_gemma":0.024640523,"threshold_uncertainty_score":0.55486405},"labels":[],"label_agreement":null},{"id":"W4416000521","doi":"10.5465/amproc.2025.13340abstract","title":"The Hype Watershed: Media Attention and Market Responses to New Venture’s Involvement with AI","year":2025,"lang":"en","type":"article","venue":"Academy of Management Proceedings","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"News media; Perception; Media coverage; Media relations; Media industry; Print media","score_opus":0.025363629368178757,"score_gpt":0.3334108704697932,"score_spread":0.3080472411016144,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416000521","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99096936,0.000103894476,0.0011187684,0.00053731847,0.00001964492,0.00003680277,0.00036210864,0.000016350592,0.006835741],"genre_scores_gemma":[0.9987729,0.000056787347,0.00034853676,0.000073934956,0.000036812486,0.000033532444,0.00015410749,0.0000074737836,0.0005159528],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99902916,0.00041409745,0.00005922947,0.0001605225,0.00019944055,0.00013753322],"domain_scores_gemma":[0.9753587,0.01573448,0.0060335123,0.0008551972,0.0012722207,0.0007459227],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00228421,0.00022776666,0.00020448487,0.0018895107,0.00066711864,0.002943276,0.00024531732,0.000490018,0.00453141],"category_scores_gemma":[0.018602025,0.0001499413,0.0002459473,0.0015858948,0.0010042618,0.003000806,0.0014583374,0.0009339067,0.00029991815],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034598837,0.0002470817,0.9225905,0.00015370458,0.000111683265,0.00028938393,0.018063782,0.00043222817,0.0038566059,0.004736979,0.0018062476,0.04736584],"study_design_scores_gemma":[0.000007834155,0.00007648472,0.9768553,0.0000395785,0.000058546473,0.000055750843,0.014025362,0.003713892,0.001084754,0.0021006735,0.00195736,0.000024486326],"about_ca_topic_score_codex":0.0035686537,"about_ca_topic_score_gemma":0.004066685,"teacher_disagreement_score":0.00453141,"about_ca_system_score_codex":0.0005734704,"about_ca_system_score_gemma":0.00045958222,"threshold_uncertainty_score":0.0151590705},"labels":[],"label_agreement":null},{"id":"W4416023471","doi":"10.48550/arxiv.2511.03980","title":"LLMs and Cultural Values: the Impact of Prompt Language and Explicit Cultural Framing","year":2025,"lang":"","type":"preprint","venue":"ArXiv.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canada First Research Excellence Fund","keywords":"Framing (construction); Cultural diversity; Hofstede's cultural dimensions theory; Cultural bias; Cultural values; Framing effect; Cultural issues; Survey data collection; Perspective (graphical)","score_opus":0.0694010047137574,"score_gpt":0.4285579792597215,"score_spread":0.35915697454596407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416023471","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9706458,0.00033031072,0.01885149,0.00087233057,0.00009920125,0.00021669715,0.00057370996,0.00021125002,0.008199318],"genre_scores_gemma":[0.9918949,0.0000868648,0.0066814614,0.00023117336,0.000016503254,0.00020680472,0.00039338358,0.00006915948,0.00041960934],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9416245,0.050767295,0.0016491157,0.0029822895,0.002258246,0.00071852206],"domain_scores_gemma":[0.6331873,0.33275297,0.011208574,0.016263926,0.005020267,0.0015669432],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04360571,0.0011550979,0.0006917792,0.00086483813,0.00092044385,0.005327943,0.00077341177,0.0010817065,0.0048328764],"category_scores_gemma":[0.21213657,0.00046520197,0.0010616801,0.0014731354,0.0021258935,0.0043633557,0.0037639188,0.0026436637,0.0008527393],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004727575,0.0008739361,0.67140806,0.0025029357,0.00084379833,0.00062165625,0.0814129,0.016304968,0.010333071,0.012203715,0.00421973,0.1945476],"study_design_scores_gemma":[0.0006069973,0.004365234,0.60055417,0.0033703647,0.0016145944,0.00091155374,0.15764478,0.112066254,0.019519852,0.052372005,0.046252713,0.0007214842],"about_ca_topic_score_codex":0.0025728226,"about_ca_topic_score_gemma":0.002310571,"teacher_disagreement_score":0.04360571,"about_ca_system_score_codex":0.0014931507,"about_ca_system_score_gemma":0.0014679737,"threshold_uncertainty_score":0.2306118},"labels":[],"label_agreement":null},{"id":"W4416035532","doi":"10.18653/v1/2025.emnlp-main.1472","title":"From Charts to Fair Narratives: Uncovering and Mitigating Geo-Economic Biases in Chart-to-Text","year":2025,"lang":"","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Compute Canada; Centre International de Recherche sur le Cancer","keywords":"Natural (archaeology); Empirical research; Government (linguistics); Natural language; Identification (biology)","score_opus":0.03350814474349846,"score_gpt":0.3652423886650845,"score_spread":0.33173424392158607,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416035532","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.77772486,0.005816507,0.15453817,0.009643647,0.0011959973,0.00091163785,0.017522179,0.0022692084,0.030377805],"genre_scores_gemma":[0.94768703,0.0006223905,0.042623896,0.00042599306,0.00024475512,0.0003466349,0.0057822946,0.00024000602,0.0020270362],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99093246,0.0052364958,0.0005752503,0.0014263133,0.0015217236,0.00030773378],"domain_scores_gemma":[0.83368945,0.124449,0.016936937,0.011668861,0.011887484,0.0013682691],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014175825,0.0005936971,0.0005015327,0.0048236977,0.0014013594,0.0048875827,0.0014614104,0.001245521,0.005126425],"category_scores_gemma":[0.2258597,0.000371776,0.00032484843,0.0064255875,0.0023743096,0.013322114,0.004686371,0.0015660103,0.0013514111],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002237464,0.0003751087,0.21330595,0.0029066845,0.00030546475,0.001267404,0.0806866,0.0064254613,0.006199392,0.09993779,0.05880618,0.5275465],"study_design_scores_gemma":[0.00021657154,0.00045042223,0.11598278,0.0025160972,0.0005290408,0.00066418055,0.089584775,0.13579004,0.016189026,0.464662,0.17302072,0.00039428537],"about_ca_topic_score_codex":0.004167018,"about_ca_topic_score_gemma":0.004909222,"teacher_disagreement_score":0.014175825,"about_ca_system_score_codex":0.0012246263,"about_ca_system_score_gemma":0.0020737604,"threshold_uncertainty_score":0.07496977},"labels":[],"label_agreement":null},{"id":"W4416036476","doi":"10.18653/v1/2025.emnlp-main.559","title":"Voice of a Continent: Mapping Africa’s Speech Technology Frontier","year":2025,"lang":"","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Alliance de recherche numérique du Canada; Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Bill and Melinda Gates Foundation","keywords":"Frontier; Natural language; Natural (archaeology); Speech technology; Speech processing; Empirical research","score_opus":0.02806218764338765,"score_gpt":0.336557888344152,"score_spread":0.3084957007007644,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416036476","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93074787,0.00838055,0.005088825,0.0054601757,0.0005252292,0.000053961943,0.007601281,0.00011874351,0.042023323],"genre_scores_gemma":[0.99030846,0.0022778946,0.0027423513,0.00016895459,0.00011043115,0.000037841575,0.0021799167,0.00003855174,0.0021356547],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99983966,0.00005059306,0.000010114415,0.000028855136,0.000022733508,0.000047996706],"domain_scores_gemma":[0.9994886,0.00020898522,0.00007195517,0.000027174236,0.00014182988,0.00006142935],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00040334117,0.00027773847,0.00014743274,0.0021281324,0.0006049155,0.0014551454,0.00023938381,0.0004023527,0.004183948],"category_scores_gemma":[0.0017566234,0.000086754575,0.00014940895,0.002729845,0.00036098526,0.00145271,0.0011403115,0.00042641614,0.0008858277],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057180005,0.00008335887,0.27261576,0.0017536214,0.00014819736,0.0030806744,0.044342645,0.0020096588,0.011791674,0.01244037,0.063962996,0.5871993],"study_design_scores_gemma":[0.000027738108,0.00008299348,0.67814565,0.0010522282,0.00014160466,0.0011087664,0.14524944,0.005537159,0.0025475,0.0065542907,0.15949027,0.0000623826],"about_ca_topic_score_codex":0.010305582,"about_ca_topic_score_gemma":0.018405696,"teacher_disagreement_score":0.010305582,"about_ca_system_score_codex":0.0003822662,"about_ca_system_score_gemma":0.0004477032,"threshold_uncertainty_score":0.020491183},"labels":[],"label_agreement":null},{"id":"W4416057143","doi":"10.48550/arxiv.2510.18803","title":"Decoding Funded Research: Comparative Analysis of Topic Models and Uncovering the Effect of Gender and Geographic Location","year":2025,"lang":"","type":"preprint","venue":"ArXiv.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Topic model; Latent Dirichlet allocation; Covariate; Probabilistic logic; Thematic map; Thematic structure; Function (biology); Statistical model","score_opus":0.3391748008106125,"score_gpt":0.47906670462399503,"score_spread":0.1398919038133825,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416057143","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8409754,0.003195142,0.14400831,0.0032250683,0.0001546557,0.00019121084,0.002416437,0.00042901374,0.005404655],"genre_scores_gemma":[0.9782591,0.0007204405,0.017519258,0.00009868167,0.00012264407,0.0001346012,0.0021352177,0.00010839849,0.0009015977],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.987324,0.009441423,0.00056877953,0.0015408079,0.00072517595,0.00039982153],"domain_scores_gemma":[0.82264537,0.16205402,0.0060374625,0.005397473,0.002809505,0.001056107],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.031302605,0.0008207517,0.0011211818,0.0039660675,0.0008755674,0.0042982674,0.0011366139,0.0015430842,0.0023917754],"category_scores_gemma":[0.14384213,0.0003763886,0.0018921907,0.006441303,0.0014225134,0.0052252687,0.002692042,0.0017007086,0.0007192814],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015345908,0.00026161177,0.49600694,0.0009234405,0.0013858585,0.00044401383,0.011786385,0.10119322,0.0018124249,0.06317347,0.009712859,0.31176507],"study_design_scores_gemma":[0.00019931138,0.00034259097,0.12739067,0.0003481214,0.0007977178,0.00039954894,0.005354702,0.7479897,0.0021214888,0.09815226,0.016743798,0.00016016081],"about_ca_topic_score_codex":0.008241712,"about_ca_topic_score_gemma":0.0090201255,"teacher_disagreement_score":0.9960339,"about_ca_system_score_codex":0.0019430694,"about_ca_system_score_gemma":0.0020591335,"threshold_uncertainty_score":0.16554594},"labels":[],"label_agreement":null},{"id":"W4416411073","doi":"10.1016/j.futures.2025.103737","title":"Yes, but…: Technology, netnography, and futures","year":2025,"lang":"en","type":"article","venue":"Futures","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Netnography; Social media; Big data; Futures contract; Vision; Social media analytics; Realm; Contrarian; Consumption (sociology)","score_opus":0.007325411273189681,"score_gpt":0.3558326368988772,"score_spread":0.3485072256256875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416411073","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18646346,0.023923824,0.018207539,0.203438,0.001823461,0.000059997867,0.00021429929,0.00014079767,0.56572866],"genre_scores_gemma":[0.9661785,0.005387181,0.0025593562,0.0041106576,0.0002845579,0.000029942112,0.000055705314,0.00004518999,0.021348806],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9985411,0.00087411614,0.000027887118,0.00014777167,0.00020080889,0.00020837018],"domain_scores_gemma":[0.9965857,0.0016877537,0.0004257302,0.00024564436,0.00032777592,0.0007272734],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028038812,0.0003360821,0.00017383695,0.0010966993,0.004920278,0.011083548,0.0006465526,0.002300641,0.008251021],"category_scores_gemma":[0.00550731,0.00018508469,0.00036187386,0.0010526222,0.022273611,0.023327038,0.0043109655,0.0039089355,0.0011806379],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004035661,0.00003693955,0.003962667,0.00012061721,0.0000100963525,0.00037994343,0.06941568,0.00024676055,0.00026955528,0.8824571,0.0128165325,0.030243687],"study_design_scores_gemma":[0.00001141764,0.00006345394,0.0038084947,0.00065425335,0.000009508069,0.0007124796,0.10153695,0.00070437475,0.0003781328,0.60654175,0.2855123,0.00006682414],"about_ca_topic_score_codex":0.003228948,"about_ca_topic_score_gemma":0.0035750074,"teacher_disagreement_score":0.011083548,"about_ca_system_score_codex":0.003138099,"about_ca_system_score_gemma":0.0017386028,"threshold_uncertainty_score":0.027602375},"labels":[],"label_agreement":null},{"id":"W4416753157","doi":"","title":"Deliberation and Policy Outcomes: Evidence from the Textual Analysis of FOMC Transcripts *","year":2025,"lang":"en","type":"preprint","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Deliberation; Construct (python library); Tone (literature); Dissent; Predictive power; Natural (archaeology)","score_opus":0.04523781637061822,"score_gpt":0.3458457691964065,"score_spread":0.30060795282578834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416753157","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95217365,0.00081200077,0.01030661,0.0035995482,0.000103594684,0.00039244376,0.009025027,0.00011657399,0.023470502],"genre_scores_gemma":[0.98899823,0.0005294702,0.0042957044,0.00027958784,0.00009646738,0.00061109866,0.0035473616,0.00005572284,0.0015864796],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9780912,0.01616663,0.00094865536,0.0010806917,0.0030624869,0.000650377],"domain_scores_gemma":[0.55231166,0.36684343,0.05563693,0.008281072,0.014795806,0.0021311163],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0154924225,0.00040334926,0.00035735455,0.0033106003,0.0012061169,0.0024269845,0.0008102263,0.0011103151,0.007932668],"category_scores_gemma":[0.23840137,0.0003119064,0.0002965525,0.0072208173,0.0020182934,0.00222138,0.0020741879,0.0011433373,0.0014232885],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004254922,0.0014067063,0.49399754,0.0049157953,0.00067211717,0.0023835953,0.20462745,0.006110978,0.0050243996,0.019779475,0.02080547,0.2360215],"study_design_scores_gemma":[0.00018984951,0.00048839086,0.84890264,0.0017917294,0.0001743806,0.0004542353,0.06834947,0.010544148,0.0043408466,0.021242168,0.04331296,0.00020915298],"about_ca_topic_score_codex":0.009457493,"about_ca_topic_score_gemma":0.0064357384,"teacher_disagreement_score":0.0154924225,"about_ca_system_score_codex":0.0016930327,"about_ca_system_score_gemma":0.0016740703,"threshold_uncertainty_score":0.08193272},"labels":[],"label_agreement":null},{"id":"W4416872671","doi":"10.1162/coli.a.583","title":"LLMs and Cultural Values: The Impact of Prompt Language and Explicit Cultural Framing","year":2025,"lang":"en","type":"article","venue":"Computational Linguistics","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Mila - Quebec Artificial Intelligence Institute","funders":"Canada First Research Excellence Fund","keywords":"Framing (construction); Cultural diversity; Cultural values; Cultural bias; Hofstede's cultural dimensions theory; Perspective (graphical); Set (abstract data type); Cultural issues; Cultural psychology","score_opus":0.031044744766767877,"score_gpt":0.43185472382640566,"score_spread":0.4008099790596378,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416872671","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97961557,0.0003008916,0.013299672,0.000660287,0.00007517185,0.00013816978,0.0004281821,0.00013749678,0.0053445566],"genre_scores_gemma":[0.9951663,0.00005831769,0.0040115905,0.00012947676,0.0000132526175,0.00011206124,0.00024873353,0.00004131433,0.0002188903],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.93296975,0.05893893,0.0017244201,0.0032027417,0.0024518094,0.00071227876],"domain_scores_gemma":[0.5311048,0.43486682,0.012752186,0.014744449,0.0049765413,0.0015551586],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.047098335,0.0010331642,0.00067696284,0.00097174227,0.000883093,0.0054226955,0.0007642927,0.0010843591,0.0046834447],"category_scores_gemma":[0.2376297,0.00046757222,0.00090062723,0.0015994976,0.0022112792,0.0039369273,0.0038940108,0.0025836308,0.0006597272],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0044373414,0.00084534584,0.72667855,0.0019504082,0.00084685,0.0005828952,0.06991451,0.018698268,0.0077138115,0.011062684,0.00339927,0.15387008],"study_design_scores_gemma":[0.0005302024,0.0037109863,0.6349207,0.003283108,0.0016884592,0.00071803865,0.13157317,0.12818293,0.017091097,0.04536349,0.032278832,0.00065891695],"about_ca_topic_score_codex":0.0024654896,"about_ca_topic_score_gemma":0.0021955476,"teacher_disagreement_score":0.047098335,"about_ca_system_score_codex":0.0015451293,"about_ca_system_score_gemma":0.0013824411,"threshold_uncertainty_score":0.2490828},"labels":[],"label_agreement":null},{"id":"W4417155617","doi":"10.1353/hms.2025.a976682","title":"A Quantitative and Comparative Approach to Royalist and Whig Sources in Hume’s History of England","year":2025,"lang":"en","type":"article","venue":"Hume studies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Royalist; Scholarship; Politics; Focus (optics); History of England","score_opus":0.2464407386154445,"score_gpt":0.4475482591343165,"score_spread":0.201107520518872,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417155617","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.926584,0.005614053,0.012440732,0.0029520993,0.0000837613,0.00008075128,0.0010119611,0.000034543893,0.05119816],"genre_scores_gemma":[0.9942239,0.00069164345,0.0028480545,0.00011022594,0.000050789225,0.00004408249,0.00021799027,0.000026586551,0.0017867319],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.98867434,0.006963719,0.000560588,0.0010810266,0.002168251,0.0005521222],"domain_scores_gemma":[0.8587404,0.11998235,0.010660286,0.003020623,0.0066887243,0.00090762],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009760339,0.00026390122,0.000678506,0.022995207,0.0043842765,0.008331577,0.0013480078,0.0014007578,0.005357701],"category_scores_gemma":[0.05714744,0.00035597372,0.0002600364,0.025872858,0.013655969,0.0075907535,0.00511728,0.0012974809,0.00031528628],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026706536,0.00007266734,0.11994199,0.0013821023,0.00021200176,0.0012540868,0.6189081,0.0010763541,0.0018554637,0.18965389,0.0032848178,0.062091455],"study_design_scores_gemma":[0.00002117376,0.0000863282,0.30762535,0.0020862597,0.00014831888,0.001331587,0.49782488,0.004536366,0.0039250553,0.053589445,0.12862785,0.00019736208],"about_ca_topic_score_codex":0.020417407,"about_ca_topic_score_gemma":0.03871369,"teacher_disagreement_score":0.022995207,"about_ca_system_score_codex":0.0076317876,"about_ca_system_score_gemma":0.0018995246,"threshold_uncertainty_score":0.055372775},"labels":[],"label_agreement":null},{"id":"W4417302723","doi":"10.1007/978-3-031-99739-6_17","title":"Quantitative and Qualitative Content Analysis of Text and Images","year":2025,"lang":"en","type":"book-chapter","venue":"Fish & fisheries series/Fish and fisheries series (Print)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Variety (cybernetics); Discipline; Recreation; Content analysis; Software; Coding (social sciences); Qualitative analysis; Visualization","score_opus":0.07678097638722706,"score_gpt":0.3393940945839126,"score_spread":0.26261311819668554,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417302723","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22809584,0.0035086195,0.23238504,0.009519701,0.0019351791,0.016755315,0.03315934,0.002011488,0.4726295],"genre_scores_gemma":[0.39258078,0.004214643,0.38014382,0.002281453,0.00059478177,0.025300367,0.013157343,0.0018719834,0.17985484],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9931545,0.00337043,0.0003110406,0.00050698686,0.0024948071,0.0001622628],"domain_scores_gemma":[0.96675235,0.025426103,0.000957844,0.0010297498,0.0056231148,0.0002109415],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008526112,0.000420809,0.0003723309,0.005557043,0.0015688519,0.003438401,0.00087874837,0.00052896194,0.022070955],"category_scores_gemma":[0.022990065,0.00018927349,0.00028937406,0.0075886203,0.0023643316,0.0026744327,0.0015626848,0.00087704364,0.0040797535],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013754745,0.00014854282,0.002771362,0.004748996,0.000028542394,0.0005140815,0.24885769,0.0010810226,0.011350323,0.11113719,0.11703494,0.5021899],"study_design_scores_gemma":[0.000031048243,0.00011867902,0.012752002,0.004350201,0.00003062451,0.00041580887,0.13697053,0.0041559585,0.013155508,0.04439633,0.7835085,0.00011477212],"about_ca_topic_score_codex":0.0016873232,"about_ca_topic_score_gemma":0.0024529765,"teacher_disagreement_score":0.022070955,"about_ca_system_score_codex":0.002767909,"about_ca_system_score_gemma":0.0026896272,"threshold_uncertainty_score":0.07383466},"labels":[],"label_agreement":null},{"id":"W4417357121","doi":"10.48550/arxiv.2506.10942","title":"Building a Media Ecosystem Observatory from Scratch: Infrastructure, Methodology, and Insights","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Digital ecosystem; Observatory; Search engine indexing; Normalization (sociology); Raw data; Digital media; Social media","score_opus":0.17087797749526187,"score_gpt":0.39400473303662614,"score_spread":0.22312675554136427,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417357121","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059675712,0.00028361232,0.8750973,0.0040867133,0.00016133428,0.0020870732,0.01597491,0.02973546,0.012897864],"genre_scores_gemma":[0.14635211,0.00029253,0.82538456,0.0003563575,0.00006756433,0.0015905172,0.019891284,0.0023602138,0.0037048303],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99528164,0.00115577,0.00035469126,0.0011283734,0.001671693,0.00040783503],"domain_scores_gemma":[0.9862861,0.0027118518,0.0007405551,0.005612136,0.0034929526,0.0011563827],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0075202836,0.000913341,0.0006060818,0.0043540625,0.0026277157,0.006147827,0.0027901954,0.0009845641,0.00337965],"category_scores_gemma":[0.02325973,0.00086686306,0.00073514465,0.0047990396,0.0022981828,0.008144781,0.0059453933,0.0023359647,0.0025661453],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000641824,0.0013339064,0.097867414,0.0014152463,0.00040144252,0.0008124604,0.011248271,0.02833546,0.038751952,0.14073198,0.096015714,0.5824443],"study_design_scores_gemma":[0.00025666534,0.00034430265,0.054289106,0.0006202716,0.00019300803,0.00048296852,0.0089247245,0.42721573,0.062431853,0.10053708,0.3442187,0.00048569],"about_ca_topic_score_codex":0.2426927,"about_ca_topic_score_gemma":0.28455532,"teacher_disagreement_score":0.99247974,"about_ca_system_score_codex":0.006001632,"about_ca_system_score_gemma":0.02176393,"threshold_uncertainty_score":0.48256016},"labels":[],"label_agreement":null},{"id":"W4417398205","doi":"10.21083/caree.v1i1.8922","title":"Evaluating the Effectiveness of Large Language Models for Livestock and Climate-Related Agricultural Advice in Ontario","year":2025,"lang":"","type":"article","venue":"Canadian Agri-food & Rural Advisory Extension and Education Journal","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Guelph","funders":"","keywords":"Comparability; Context (archaeology); Quality (philosophy); Agriculture; Livestock; Reliability (semiconductor)","score_opus":0.030743935412408666,"score_gpt":0.35220213820322815,"score_spread":0.3214582027908195,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417398205","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96993816,0.00045659096,0.015060859,0.0011378061,0.000044799694,0.00092006376,0.0028629182,0.0020675194,0.00751125],"genre_scores_gemma":[0.94857574,0.00038027065,0.03835571,0.00021177645,0.000017858612,0.0006409569,0.0068840818,0.00013923478,0.0047944672],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9954613,0.002545263,0.0003596693,0.0006985526,0.00075963995,0.00017559883],"domain_scores_gemma":[0.9558826,0.036253337,0.0012323603,0.0013102129,0.004672002,0.0006494696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007398205,0.0009387415,0.00062375946,0.0012891036,0.0010266398,0.0017062553,0.001731317,0.0013990733,0.0033058252],"category_scores_gemma":[0.042024832,0.00039178322,0.0008794315,0.0013133147,0.00085258455,0.0017235597,0.0016097057,0.0009067851,0.00083517184],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005604561,0.0037556994,0.13843502,0.0058853854,0.00053243956,0.0015896801,0.046293262,0.3052491,0.020839995,0.0065170233,0.022454299,0.4428435],"study_design_scores_gemma":[0.00066694204,0.002008797,0.0516954,0.00046935145,0.00040231898,0.00021183732,0.01095639,0.8782404,0.011489082,0.0031865244,0.040385127,0.00028786447],"about_ca_topic_score_codex":0.50861984,"about_ca_topic_score_gemma":0.5944052,"teacher_disagreement_score":0.49138016,"about_ca_system_score_codex":0.015144079,"about_ca_system_score_gemma":0.010822062,"threshold_uncertainty_score":0.988548},"labels":[],"label_agreement":null},{"id":"W6892830738","doi":"10.5281/zenodo.12011536","title":"Scarlet Cloak and the Forest Adventure: The Issue of False Positives in AI Detection Tools","year":2024,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Generative grammar; Grammar; False positive paradox; Production (economics); Selection (genetic algorithm); Discipline; Natural language generation; Prototype theory","score_opus":0.02969739178697276,"score_gpt":0.3148960804134628,"score_spread":0.28519868862649,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6892830738","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010936863,0.023231514,0.09429735,0.8292681,0.0058927354,0.000200181,0.00029152966,0.002384764,0.033496995],"genre_scores_gemma":[0.32958427,0.012953408,0.24097557,0.35937798,0.011709712,0.00088949344,0.00034634038,0.0035174477,0.04064582],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.8696675,0.07970145,0.0049074953,0.011678003,0.0326433,0.0014021972],"domain_scores_gemma":[0.2804424,0.6576562,0.011830231,0.02032756,0.027102165,0.0026415212],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15377882,0.0014572116,0.002116653,0.0067555276,0.008316663,0.016479848,0.006111692,0.020953914,0.008756043],"category_scores_gemma":[0.5260125,0.0020793374,0.0014712625,0.0032876034,0.033588994,0.03381523,0.0066490793,0.023705356,0.0056258566],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058742065,0.00015457481,0.015473446,0.0007900279,0.00017532015,0.0025140997,0.021132467,0.0020031473,0.0011739705,0.2091831,0.32835624,0.41845623],"study_design_scores_gemma":[0.0002236581,0.000258666,0.0053986283,0.0032229412,0.00018164939,0.006546316,0.0079387855,0.016232084,0.004948849,0.574902,0.37963086,0.0005155471],"about_ca_topic_score_codex":0.012740018,"about_ca_topic_score_gemma":0.011864262,"teacher_disagreement_score":0.8462212,"about_ca_system_score_codex":0.00476627,"about_ca_system_score_gemma":0.0050909733,"threshold_uncertainty_score":0.81326985},"labels":[],"label_agreement":null},{"id":"W6893056006","doi":"10.5281/zenodo.14083007","title":"Cognitive diversity and the future of crises: an analysis of the topic space of the biological sciences","year":2024,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung","keywords":"Operationalization; Variety (cybernetics); Diversity (politics); Cognition; Space (punctuation); Vocabulary; Discipline","score_opus":0.09020227650772451,"score_gpt":0.34520945129628355,"score_spread":0.25500717478855905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6893056006","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9421927,0.001835358,0.044014104,0.0024765627,0.00003812579,0.00007939643,0.00056463765,0.00006448571,0.008734806],"genre_scores_gemma":[0.99687445,0.00018334256,0.002439144,0.00002605238,0.000043591597,0.000046859815,0.00022260068,0.000009273206,0.00015478015],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99379385,0.004063192,0.00024393348,0.000656375,0.00082108326,0.00042158962],"domain_scores_gemma":[0.945772,0.0463889,0.003631582,0.0012655036,0.0015569314,0.0013850275],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0073884274,0.00041286286,0.00065688253,0.012438554,0.0018670025,0.0063532637,0.00091817527,0.0009908307,0.003775598],"category_scores_gemma":[0.04276346,0.00023975773,0.0011640892,0.011856181,0.004024471,0.0069305403,0.0048816632,0.0011694412,0.00022698751],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014622229,0.00030153632,0.4330656,0.0010843739,0.00072827813,0.00082099106,0.11871389,0.019597322,0.0024875787,0.27304667,0.0034308753,0.14526063],"study_design_scores_gemma":[0.0001726445,0.00031582822,0.321938,0.00035990062,0.00033730487,0.0008963378,0.096935235,0.10649586,0.0007569403,0.45678002,0.014854881,0.00015704222],"about_ca_topic_score_codex":0.0036790194,"about_ca_topic_score_gemma":0.0016642285,"teacher_disagreement_score":0.9926116,"about_ca_system_score_codex":0.0015813193,"about_ca_system_score_gemma":0.0011236623,"threshold_uncertainty_score":0.039074183},"labels":[],"label_agreement":null},{"id":"W6893701588","doi":"10.5281/zenodo.3626814","title":"A Workflow Analysis Perspective to Scholarly Research Tasks - Auxiliary materials","year":2020,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Nederlandse Organisatie voor Wetenschappelijk Onderzoek","keywords":"Workflow; Perspective (graphical); Ontology; Domain (mathematical analysis); Interview; Coding (social sciences)","score_opus":0.13609475359771903,"score_gpt":0.38590773434839876,"score_spread":0.24981298075067973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6893701588","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005425652,0.0030597032,0.8073228,0.035699204,0.001151349,0.0014317281,0.0027688153,0.0013629432,0.14177772],"genre_scores_gemma":[0.1075655,0.008193135,0.7862178,0.0039609703,0.0014895926,0.0036316062,0.008497335,0.0026375838,0.07780652],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.98305595,0.010984548,0.0012430089,0.0011348485,0.0027464265,0.00083516876],"domain_scores_gemma":[0.96045935,0.026565032,0.0014694787,0.0041779387,0.0056052776,0.0017230205],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.020811995,0.0014496587,0.0007621138,0.009183578,0.0058103222,0.021881197,0.0031399585,0.0030230957,0.03209338],"category_scores_gemma":[0.027730882,0.00103268,0.0018858325,0.0145246405,0.008717593,0.022360262,0.0058190324,0.005013975,0.009597601],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000046733458,0.00009696677,0.0004096849,0.00077300315,0.000013084858,0.00021604652,0.014949658,0.001226945,0.0008621825,0.8825559,0.02959516,0.06925452],"study_design_scores_gemma":[0.000023772945,0.000030467914,0.0006094327,0.0014910882,0.000015763808,0.00026088825,0.01522099,0.0033196642,0.0014454598,0.4027277,0.5748121,0.000042570806],"about_ca_topic_score_codex":0.010542787,"about_ca_topic_score_gemma":0.0081401635,"teacher_disagreement_score":0.979188,"about_ca_system_score_codex":0.010912858,"about_ca_system_score_gemma":0.017450012,"threshold_uncertainty_score":0.11006564},"labels":[],"label_agreement":null},{"id":"W6894249203","doi":"10.5683/sp3/um9zes","title":"Post-fire Recovery of Soil Organic Layer Carbon in Canadian Boreal Forests, 2015-2018","year":2024,"lang":"en","type":"dataset","venue":"Borealis","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval; Wilfrid Laurier University; University of Guelph","funders":"","keywords":"Transect; Boreal; Soil carbon; Taiga; Total organic carbon; Deciduous; Soil water; Soil horizon; Topsoil","score_opus":0.020466984623666595,"score_gpt":0.3233601168471219,"score_spread":0.3028931322234553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6894249203","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17772622,0.0031445588,0.00049026875,0.00065436214,0.00022069186,0.00007960257,0.80645907,0.0004763867,0.010748792],"genre_scores_gemma":[0.35527042,0.0023759988,0.0016330095,0.00046200893,0.0000811373,0.00011802031,0.6305148,0.00012639351,0.0094181625],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.9992931,0.000012276862,0.000036513648,0.00012969741,0.00032738879,0.00020099098],"domain_scores_gemma":[0.9968966,0.000045488545,0.00020824278,0.00011677507,0.0023605663,0.0003723164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006752033,0.0008077783,0.0004588635,0.0029647676,0.001982967,0.0011536182,0.0013676188,0.0003757005,0.005438615],"category_scores_gemma":[0.0014885922,0.0002654023,0.00069753634,0.004526214,0.00039543211,0.0007290412,0.0010823157,0.0006561742,0.0011839748],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054738024,0.00009199486,0.6450495,0.00080444233,0.00049020495,0.00025768974,0.000790777,0.0017127777,0.0023206228,0.0008286632,0.2987511,0.04835479],"study_design_scores_gemma":[0.000019947745,0.000010335853,0.9699943,0.00008590123,0.000037954516,0.00004263652,0.00029866266,0.00041216632,0.00023452613,0.000038314778,0.02879907,0.000026165488],"about_ca_topic_score_codex":0.9928235,"about_ca_topic_score_gemma":0.997168,"teacher_disagreement_score":0.01665098,"about_ca_system_score_codex":0.01665098,"about_ca_system_score_gemma":0.023903279,"threshold_uncertainty_score":0.12081188},"labels":[],"label_agreement":null},{"id":"W6904427737","doi":"10.1371/journal.pone.0245533.s001","title":"S1 Appendix -","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Task (project management); Set (abstract data type); Software; Control (management); Gender gap; Social media; Data set; News media","score_opus":0.10667567939040441,"score_gpt":0.4050596373774522,"score_spread":0.2983839579870478,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6904427737","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010107992,0.0001595581,0.0041102963,0.000759025,0.0006518161,0.0015599094,0.9631892,0.00123971,0.027319701],"genre_scores_gemma":[0.012822258,0.0007522356,0.025059287,0.0035684225,0.0004981573,0.017682638,0.8480183,0.0030104332,0.088588275],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99670416,0.00086392596,0.0006888528,0.0005996609,0.0009426071,0.00020075974],"domain_scores_gemma":[0.93232113,0.039730687,0.0029619704,0.0063163457,0.017157914,0.0015120554],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0042119385,0.0012194768,0.0011588439,0.0057684965,0.0022817575,0.0030255716,0.0020778251,0.0017881996,0.852396],"category_scores_gemma":[0.08265799,0.0010534077,0.0008518513,0.0068003684,0.00067534036,0.0029061106,0.0021085988,0.0019361592,0.42916533],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009347656,0.00007219541,0.0016815177,0.0008213094,0.000014330242,0.00004420239,0.00016120632,0.00016445042,0.00010093278,0.0013342028,0.9807114,0.014800801],"study_design_scores_gemma":[0.00031652124,0.00009932331,0.010713536,0.0014814035,0.000038254188,0.00026209443,0.0008290824,0.00053110323,0.0003512076,0.009558998,0.9757471,0.00007142966],"about_ca_topic_score_codex":0.010927099,"about_ca_topic_score_gemma":0.01566273,"teacher_disagreement_score":0.14760399,"about_ca_system_score_codex":0.0018342129,"about_ca_system_score_gemma":0.0042358995,"threshold_uncertainty_score":0.2105391},"labels":[],"label_agreement":null},{"id":"W6906638008","doi":"10.17605/osf.io/mpz63","title":"Parents in Parliament Dataset","year":2021,"lang":"en","type":"other","venue":"OSF Preprints (OSF Preprints)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Parliament; Government (linguistics); Work (physics); Legislation","score_opus":0.04063871321733869,"score_gpt":0.3627215805217325,"score_spread":0.3220828673043938,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6906638008","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008967408,0.0000678932,0.000039417235,0.000102965794,0.000025109226,0.000025995225,0.9962786,0.00014505086,0.0024182268],"genre_scores_gemma":[0.0018937659,0.00007273209,0.00020204707,0.00006930964,0.000012805584,0.0000894718,0.9914193,0.00006053699,0.006179955],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990495,0.00010401276,0.00004869358,0.00015321831,0.0003138581,0.00033070828],"domain_scores_gemma":[0.99785113,0.00028975922,0.00011883248,0.00024208095,0.0010716707,0.00042652612],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006475982,0.0014606932,0.00108704,0.0053761825,0.0027323165,0.0018025116,0.0019377439,0.0016809873,0.07559249],"category_scores_gemma":[0.0041092094,0.0005247541,0.0010688881,0.0074991663,0.00050525425,0.00066179177,0.0017571261,0.0013795091,0.052911192],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000047453068,0.000019564182,0.002220681,0.00013158146,0.000020767753,0.000041297197,0.00009376677,0.00014667764,0.00008032628,0.000492529,0.9937551,0.0029502565],"study_design_scores_gemma":[0.00008133765,0.000009978408,0.027977994,0.00013102585,0.000031524818,0.000050308434,0.0005690215,0.0003892513,0.00026742124,0.00034216847,0.9701221,0.000027886055],"about_ca_topic_score_codex":0.813637,"about_ca_topic_score_gemma":0.9116969,"teacher_disagreement_score":0.813637,"about_ca_system_score_codex":0.0055689504,"about_ca_system_score_gemma":0.013800628,"threshold_uncertainty_score":0.37492096},"labels":[],"label_agreement":null},{"id":"W6911777329","doi":"10.5281/zenodo.14245489","title":"FR.POL.GEN: A repository for textual analysis of all 'general policy speeches' from the Fifth French Republic.","year":2024,"lang":"fr","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Scripting language; Annotation; Natural language; Knowledge base; Natural (archaeology); Digital humanities","score_opus":0.07004695761329054,"score_gpt":0.3470227756223349,"score_spread":0.27697581800904436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6911777329","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042547486,0.00058028835,0.011286547,0.00024436775,0.00010167187,0.000114209346,0.94869447,0.021941733,0.012781963],"genre_scores_gemma":[0.011247059,0.00045419938,0.013889584,0.00008169232,0.000045412376,0.00038432895,0.96005726,0.005061626,0.008778787],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989649,0.00029660002,0.00014360144,0.0002105497,0.00030603408,0.00007829277],"domain_scores_gemma":[0.9962373,0.0018432718,0.00033411846,0.0006627544,0.0007897229,0.00013278089],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011097176,0.0013973583,0.0007073969,0.0072592306,0.0007064123,0.0017034765,0.000905868,0.00091874273,0.082270846],"category_scores_gemma":[0.0059488467,0.00074183947,0.0005724658,0.0061828555,0.00045346117,0.0018163371,0.0012582307,0.0008198044,0.05841601],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004759248,0.000066869834,0.004444511,0.0035591982,0.00009830016,0.00072076713,0.0025858674,0.0012407583,0.00933357,0.0051443283,0.8044886,0.16784127],"study_design_scores_gemma":[0.000054964938,0.000031043943,0.0092524,0.00028086398,0.00003081158,0.00038752911,0.00065078243,0.0011695287,0.0042081657,0.0015734696,0.98229915,0.00006129414],"about_ca_topic_score_codex":0.019238887,"about_ca_topic_score_gemma":0.020930635,"teacher_disagreement_score":0.082270846,"about_ca_system_score_codex":0.0012562776,"about_ca_system_score_gemma":0.00232754,"threshold_uncertainty_score":0.27522337},"labels":[],"label_agreement":null},{"id":"W6912134876","doi":"10.5281/zenodo.14083006","title":"Cognitive diversity and the future of crises: an analysis of the topic space of the biological sciences","year":2024,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung","keywords":"Operationalization; Variety (cybernetics); Diversity (politics); Cognition; Space (punctuation); Vocabulary; Discipline","score_opus":0.09020227650772451,"score_gpt":0.34520945129628355,"score_spread":0.25500717478855905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6912134876","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9421927,0.001835358,0.044014104,0.0024765627,0.00003812579,0.00007939643,0.00056463765,0.00006448571,0.008734806],"genre_scores_gemma":[0.99687445,0.00018334256,0.002439144,0.00002605238,0.000043591597,0.000046859815,0.00022260068,0.000009273206,0.00015478015],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99379385,0.004063192,0.00024393348,0.000656375,0.00082108326,0.00042158962],"domain_scores_gemma":[0.945772,0.0463889,0.003631582,0.0012655036,0.0015569314,0.0013850275],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0073884274,0.00041286286,0.00065688253,0.012438554,0.0018670025,0.0063532637,0.00091817527,0.0009908307,0.003775598],"category_scores_gemma":[0.04276346,0.00023975773,0.0011640892,0.011856181,0.004024471,0.0069305403,0.0048816632,0.0011694412,0.00022698751],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014622229,0.00030153632,0.4330656,0.0010843739,0.00072827813,0.00082099106,0.11871389,0.019597322,0.0024875787,0.27304667,0.0034308753,0.14526063],"study_design_scores_gemma":[0.0001726445,0.00031582822,0.321938,0.00035990062,0.00033730487,0.0008963378,0.096935235,0.10649586,0.0007569403,0.45678002,0.014854881,0.00015704222],"about_ca_topic_score_codex":0.0036790194,"about_ca_topic_score_gemma":0.0016642285,"teacher_disagreement_score":0.9926116,"about_ca_system_score_codex":0.0015813193,"about_ca_system_score_gemma":0.0011236623,"threshold_uncertainty_score":0.039074183},"labels":[],"label_agreement":null},{"id":"W6912875690","doi":"10.5281/zenodo.7406620","title":"WATCH! NFR RODEO Live Stream Free Las Vegas 2022!","year":2022,"lang":"en","type":"review","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Las vegas; Globe; Metadata; Quarter (Canadian coin); Session (web analytics); George (robot); Microform; Performance art","score_opus":0.13169930444231517,"score_gpt":0.3712090685150617,"score_spread":0.23950976407274652,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6912875690","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027508,0.0007644697,0.0011297204,0.001195691,0.0017284052,0.0001468378,0.72281736,0.026432788,0.24303389],"genre_scores_gemma":[0.005795383,0.00045795194,0.0015448348,0.00066553504,0.00016735194,0.00016972235,0.8250793,0.007054972,0.15906495],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9997236,0.000027221846,0.0000083961095,0.000074172785,0.000077858545,0.000088843575],"domain_scores_gemma":[0.99945325,0.000052940413,0.000020883526,0.0001536423,0.00016686863,0.00015243486],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0003657603,0.0011650854,0.0008619575,0.0013735691,0.0014910486,0.0033178944,0.0012094664,0.00088790513,0.4717322],"category_scores_gemma":[0.0016794819,0.00047974035,0.00068973016,0.0019018966,0.00029738064,0.0032966468,0.0030294433,0.0015253824,0.48512855],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000032028576,0.000005857615,0.00017558792,0.000044998305,0.0000029661235,0.000011494298,0.000020317306,0.000019200337,0.00007175693,0.00017585656,0.9954117,0.004028181],"study_design_scores_gemma":[0.000013863829,0.0000061140126,0.0011974636,0.000049332106,0.0000026428158,0.000017772873,0.00013847332,0.00006503068,0.000119093216,0.00022394449,0.9981559,0.0000102080885],"about_ca_topic_score_codex":0.041624557,"about_ca_topic_score_gemma":0.12591095,"teacher_disagreement_score":0.5282678,"about_ca_system_score_codex":0.0008027653,"about_ca_system_score_gemma":0.00059599016,"threshold_uncertainty_score":0.7535099},"labels":[],"label_agreement":null},{"id":"W6921056134","doi":"10.6084/m9.figshare.28166496","title":"Policies in Parallel? A Comparative Study of Journalistic AI Policies in 52 Global News Organisations","year":2025,"lang":"en","type":"article","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Transparency (behavior); Set (abstract data type); Generative grammar; Key (lock); Dynamics (music); Corporate governance; Inequality","score_opus":0.13970464101675611,"score_gpt":0.48035885634508246,"score_spread":0.34065421532832635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6921056134","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9769893,0.0005550635,0.00025620186,0.0021764594,0.000029517729,0.00003293047,0.00005059956,0.000009127185,0.019900873],"genre_scores_gemma":[0.9982917,0.0002609981,0.000115280214,0.0002818571,0.000015608952,0.00002327471,0.00003598908,0.000010844098,0.000964514],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.97920716,0.013202796,0.001186913,0.001182809,0.002661749,0.0025586332],"domain_scores_gemma":[0.89121133,0.077691935,0.015810126,0.0035183516,0.0064358325,0.0053324127],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019123275,0.00016663292,0.0005724901,0.004275993,0.0054009953,0.014384594,0.00081255863,0.0014448885,0.0039556776],"category_scores_gemma":[0.080412075,0.00036671312,0.00019471266,0.008062541,0.009055119,0.009032418,0.0049933232,0.0018505722,0.00039168895],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003611739,0.00023027229,0.099161394,0.00032057977,0.000068548725,0.0007316873,0.83284664,0.00018585045,0.0007161249,0.029084764,0.0012273063,0.035065703],"study_design_scores_gemma":[0.000040684394,0.00015354539,0.13737118,0.0002109289,0.000037176134,0.00015562272,0.8258073,0.00029240863,0.00040962154,0.0035811625,0.03189945,0.00004089613],"about_ca_topic_score_codex":0.014394081,"about_ca_topic_score_gemma":0.016582241,"teacher_disagreement_score":0.019123275,"about_ca_system_score_codex":0.006631042,"about_ca_system_score_gemma":0.005496172,"threshold_uncertainty_score":0.10113472},"labels":[],"label_agreement":null},{"id":"W6921288680","doi":"10.6084/m9.figshare.c.6667648.v1","title":"1-year survival in haemophagocytic lymphohistiocytosis: a nationwide cohort study from England 2003–2018","year":2023,"lang":"en","type":"other","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Comorbidity; Proportional hazards model; Malignancy; Confidence interval; Young adult; Cohort study; Survival analysis; Epidemiology; Disease","score_opus":0.06540386323493667,"score_gpt":0.3568850861123218,"score_spread":0.2914812228773851,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6921288680","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99187917,0.0007068189,0.00013205259,0.00016876131,0.000015685753,0.000019787527,0.0066486807,0.0000051817274,0.0004237392],"genre_scores_gemma":[0.99546236,0.0003324723,0.00007710859,0.0000885879,0.000011829113,0.000033181106,0.0035703513,0.0000037665818,0.00042016312],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9992249,0.0001738222,0.0001277811,0.00022179405,0.00009938399,0.00015231244],"domain_scores_gemma":[0.9977617,0.00020591101,0.0009582078,0.00020515735,0.00055329024,0.00031572464],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009904886,0.00025203385,0.00049190375,0.0006897581,0.0005115816,0.0009395629,0.0006208251,0.000493954,0.0024323459],"category_scores_gemma":[0.0030149622,0.0005080115,0.0008546452,0.0012250202,0.00023409765,0.0010374701,0.001211929,0.0008160807,0.00050300057],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008984101,0.00002127009,0.9977392,0.000043476022,0.00008495081,0.00013227465,0.00039546465,0.000046094367,0.00008799382,0.000032080545,0.0006502152,0.00067719806],"study_design_scores_gemma":[0.000009370936,0.000045537367,0.9983559,0.000050062787,0.000042844298,0.00021283026,0.00047222464,0.00013733048,0.00001667219,0.000017998127,0.00063340116,0.000005792873],"about_ca_topic_score_codex":0.1336101,"about_ca_topic_score_gemma":0.1567206,"teacher_disagreement_score":0.1336101,"about_ca_system_score_codex":0.0011663096,"about_ca_system_score_gemma":0.0006976041,"threshold_uncertainty_score":0.26566482},"labels":[],"label_agreement":null},{"id":"W6923564522","doi":"10.14288/1.0395964","title":"Adapting inpatient addiction medicine consult services during the COVID-19 pandemic","year":2021,"lang":"en","type":"article","venue":"Open Collections","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Pandemic; Harm; Buprenorphine; Outreach; Addiction; Medical prescription; Health care; Telemedicine; Substance abuse","score_opus":0.09156354926212208,"score_gpt":0.4079555221234544,"score_spread":0.3163919728613323,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6923564522","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.72138923,0.0022214807,0.0043733604,0.2145993,0.0050250925,0.0023119359,0.0012222754,0.0007154578,0.048141975],"genre_scores_gemma":[0.898442,0.0023632399,0.011497308,0.077120334,0.0012329766,0.0014333645,0.001116611,0.00017478598,0.006619434],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98897225,0.004808552,0.00061567605,0.00043739006,0.0016972211,0.0034689212],"domain_scores_gemma":[0.9810736,0.0021543524,0.0019563378,0.0009816532,0.003082679,0.010751319],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0076149125,0.00036860054,0.0003065156,0.00061510655,0.0055142194,0.0032426605,0.002412834,0.001876982,0.0065827835],"category_scores_gemma":[0.024147488,0.00041750734,0.0008257177,0.00090808165,0.001632028,0.0019993666,0.008816878,0.003914671,0.00059548055],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053344545,0.0026037446,0.25666946,0.0015068628,0.00021794441,0.0044524414,0.041306496,0.0028444403,0.002877315,0.0044191363,0.20431846,0.47825027],"study_design_scores_gemma":[0.00025166548,0.0018839646,0.49219498,0.0036933264,0.000121182566,0.0017343073,0.13140556,0.0022496395,0.0016629465,0.0023378076,0.36220312,0.0002615824],"about_ca_topic_score_codex":0.07655975,"about_ca_topic_score_gemma":0.22319569,"teacher_disagreement_score":0.07655975,"about_ca_system_score_codex":0.014417541,"about_ca_system_score_gemma":0.031086173,"threshold_uncertainty_score":0.15222824},"labels":[],"label_agreement":null},{"id":"W6924778299","doi":"10.15468/dl.qrbw5m","title":"Occurrence Download","year":2022,"lang":"en","type":"dataset","venue":"Global Biodiversity Information Facility","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Download; Matching (statistics); Range (aeronautics); Set (abstract data type); Data set","score_opus":0.03034390787589907,"score_gpt":0.2976054888939758,"score_spread":0.26726158101807673,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6924778299","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00004782963,0.000025376796,0.000059411963,0.000037545775,0.000011546854,0.000006180209,0.99872416,0.0004311376,0.00065671885],"genre_scores_gemma":[0.00016321556,0.000029117982,0.00025409498,0.00004119292,0.0000032983844,0.00005319496,0.9988507,0.00016421947,0.00044097583],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989034,0.00016937022,0.00013878095,0.00037122995,0.00025482842,0.0001624559],"domain_scores_gemma":[0.9975024,0.0007736162,0.00021675412,0.0006276309,0.0005940686,0.00028546815],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001200719,0.0019811983,0.0014902445,0.0048691593,0.0010864142,0.002552188,0.0029960263,0.0019868815,0.14448643],"category_scores_gemma":[0.0065528164,0.00086368475,0.0011952161,0.008617043,0.00047312494,0.0020306052,0.002427667,0.0021309066,0.20563306],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026086382,0.000012288899,0.0003424521,0.00045699443,0.000014052738,0.000014118129,0.00002394074,0.000117594376,0.00010403531,0.0004169049,0.99710506,0.0013665563],"study_design_scores_gemma":[0.000076534394,0.0000076484375,0.0016728834,0.00016576344,0.000014397017,0.000036468162,0.00007663673,0.00019039103,0.00020361677,0.00095192797,0.99658656,0.00001723671],"about_ca_topic_score_codex":0.018762553,"about_ca_topic_score_gemma":0.033608712,"teacher_disagreement_score":0.8555136,"about_ca_system_score_codex":0.0016241295,"about_ca_system_score_gemma":0.0024614458,"threshold_uncertainty_score":0.48335522},"labels":[],"label_agreement":null},{"id":"W6924823737","doi":"10.15468/dl.zhseaj","title":"Occurrence Download","year":2023,"lang":"en","type":"dataset","venue":"Global Biodiversity Information Facility","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Download; Matching (statistics); Range (aeronautics); R package; The Internet","score_opus":0.03824399629464364,"score_gpt":0.310753986181779,"score_spread":0.2725099898871354,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6924823737","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000047332174,0.000025664136,0.00005356333,0.00003838523,0.000011709135,0.0000063927205,0.99886525,0.00039068286,0.00056095223],"genre_scores_gemma":[0.00017190218,0.00003101023,0.00025116792,0.00004515974,0.0000036764382,0.000056775727,0.99884665,0.00014290687,0.00045074013],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99889165,0.0001723308,0.0001430708,0.0003881694,0.00024092036,0.0001640085],"domain_scores_gemma":[0.9972934,0.00087305054,0.00025041503,0.0006665334,0.0006108337,0.0003057173],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0011499188,0.0019465717,0.0015498106,0.0049788244,0.0010339278,0.0025703069,0.002919723,0.0021114373,0.14417273],"category_scores_gemma":[0.006634884,0.0008400357,0.0012387783,0.008955251,0.00047496613,0.0020842736,0.0024966863,0.0021239654,0.20541681],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000028359877,0.000013046819,0.00038313927,0.0005310785,0.000015244681,0.000014934703,0.000025092844,0.00013163757,0.00010534632,0.0003976944,0.9969236,0.0014307743],"study_design_scores_gemma":[0.00008797901,0.0000099246445,0.0019708904,0.00019832316,0.000017542185,0.0000405556,0.000085155814,0.00021048106,0.00021257375,0.0010444927,0.99610245,0.000019599232],"about_ca_topic_score_codex":0.017694404,"about_ca_topic_score_gemma":0.03213508,"teacher_disagreement_score":0.8558273,"about_ca_system_score_codex":0.0015806691,"about_ca_system_score_gemma":0.0024405408,"threshold_uncertainty_score":0.48230582},"labels":[],"label_agreement":null},{"id":"W6925328710","doi":"10.17605/osf.io/ucz9t","title":"Parents in Parliament Dataset","year":2021,"lang":"en","type":"article","venue":"OSF Preprints (OSF Preprints)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Parliament; Government (linguistics); Work (physics); Legislation","score_opus":0.04116252127192363,"score_gpt":0.3605998412627025,"score_spread":0.31943731999077885,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6925328710","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018793115,0.000104558836,0.00005142418,0.00013203718,0.000027788103,0.000035662568,0.9948999,0.00015550069,0.0027136707],"genre_scores_gemma":[0.003681815,0.00009914361,0.00024864142,0.000083868195,0.000015370908,0.00011172442,0.98890287,0.000056904028,0.0067996336],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99904484,0.000107666514,0.000046471632,0.00015018233,0.00031835985,0.00033249886],"domain_scores_gemma":[0.9979736,0.00027610487,0.00011962052,0.00020939209,0.0010147034,0.00040664943],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005964143,0.0013498019,0.0010598141,0.0053069494,0.002770162,0.00164279,0.00178638,0.0016068905,0.049623452],"category_scores_gemma":[0.0037533802,0.000502707,0.0009973514,0.007384267,0.0005240768,0.000599132,0.0016454856,0.0013115966,0.03191958],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007852806,0.000028975715,0.0041835723,0.00018619055,0.000034135,0.00007123462,0.00016615307,0.00023092236,0.0001532339,0.0006334872,0.9898414,0.004392201],"study_design_scores_gemma":[0.000087499735,0.000012577758,0.046338253,0.00013787935,0.000045364188,0.000069463655,0.00083703233,0.0005074009,0.00039149082,0.00032325296,0.95121586,0.000033884633],"about_ca_topic_score_codex":0.85950845,"about_ca_topic_score_gemma":0.93527114,"teacher_disagreement_score":0.85950845,"about_ca_system_score_codex":0.0062622535,"about_ca_system_score_gemma":0.0150511805,"threshold_uncertainty_score":0.28263783},"labels":[],"label_agreement":null},{"id":"W6925562214","doi":"10.17895/ices.pub.19265252.v1","title":"Report of the Working Group on the Application of Genetics in Fisheries and Mariculture (WGAGFM)","year":2002,"lang":"en","type":"report","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Mariculture; Group (periodic table); Fish <Actinopterygii>; Work (physics); Aquaculture","score_opus":0.1571355801211041,"score_gpt":0.3558157031585857,"score_spread":0.1986801230374816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6925562214","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010750404,0.013673489,0.033198178,0.049744815,0.019792182,0.0045100306,0.64104867,0.005611047,0.22167125],"genre_scores_gemma":[0.018008016,0.008860681,0.049074635,0.00332419,0.002556352,0.0033373549,0.3271648,0.002851912,0.5848221],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.997521,0.00052813045,0.000116969735,0.0002692708,0.0012703879,0.00029420748],"domain_scores_gemma":[0.97912794,0.0022029863,0.000603615,0.0012586004,0.0130505245,0.0037564477],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009386794,0.002003072,0.0012064604,0.004794457,0.0017332194,0.0025430468,0.0024590737,0.001287387,0.07723304],"category_scores_gemma":[0.009907241,0.0005998342,0.00081455556,0.0038874517,0.00084303383,0.0012082815,0.0018616102,0.0017958294,0.0331216],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011810969,0.000071714516,0.0011940921,0.00013084627,0.000016598155,0.000031947104,0.00009061192,0.00019794218,0.0002774928,0.0007068907,0.97452646,0.022637285],"study_design_scores_gemma":[0.00011759033,0.00008735938,0.019077428,0.00023145604,0.000073698306,0.0000811945,0.00029020238,0.0004636908,0.001914778,0.0010654358,0.9765555,0.00004158938],"about_ca_topic_score_codex":0.24018101,"about_ca_topic_score_gemma":0.25026417,"teacher_disagreement_score":0.24018101,"about_ca_system_score_codex":0.0038857185,"about_ca_system_score_gemma":0.026093261,"threshold_uncertainty_score":0.47756606},"labels":[],"label_agreement":null},{"id":"W6925921358","doi":"10.20381/ruor-22758","title":"Arctic Corridors and Northern Voices: Governing marine transportation in the Canadian Arctic (Coral Harbour, Nunavut community report).","year":2018,"lang":"en","type":"other","venue":"University of Ottawa - Library","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Arctic; Government (linguistics); Marine conservation; Circumpolar star; Livelihood; The arctic; Marine habitats; General partnership; Marine debris; Marine pollution","score_opus":0.01938918848144215,"score_gpt":0.24337971329664626,"score_spread":0.2239905248152041,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6925921358","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14680086,0.048032477,0.0017143638,0.17109899,0.0027627333,0.0007848772,0.03301285,0.00027657003,0.59551626],"genre_scores_gemma":[0.6485432,0.049576003,0.0051098266,0.012311743,0.00037106752,0.0008354658,0.012425713,0.0002576381,0.27056938],"study_design_codex":"not_applicable","study_design_gemma":"qualitative","domain_scores_codex":[0.99850863,0.00015245224,0.00006674604,0.000107569635,0.0006527183,0.00051180803],"domain_scores_gemma":[0.9966864,0.0003435039,0.00018370822,0.00007126175,0.0016394549,0.0010757633],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021583613,0.00041573663,0.00014174062,0.0018103437,0.014226063,0.0044907588,0.0012332916,0.0013183182,0.0076237964],"category_scores_gemma":[0.0045491788,0.00031883497,0.00022672406,0.0063561574,0.002577971,0.0016292373,0.0025826516,0.0013512836,0.0005180751],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000060119382,0.000051891526,0.045835905,0.00049607526,0.000019065483,0.000701852,0.11865317,0.0004293338,0.0004651329,0.026756573,0.66397893,0.14255193],"study_design_scores_gemma":[0.000010250862,0.00000998369,0.12547842,0.0005908992,0.00002419801,0.00008593745,0.15257044,0.0001254581,0.00024358874,0.0011997584,0.7195954,0.00006572127],"about_ca_topic_score_codex":0.99757,"about_ca_topic_score_gemma":0.9991887,"teacher_disagreement_score":0.049162365,"about_ca_system_score_codex":0.049162365,"about_ca_system_score_gemma":0.23370491,"threshold_uncertainty_score":0.3566996},"labels":[],"label_agreement":null},{"id":"W6926314824","doi":"10.25318/3810011201-fra","title":"Certaines activités agricoles, toutes les aires de drainage principales et sous-aires de drainage avec agriculture","year":2019,"lang":"fr","type":"dataset","venue":"Statistics Canada Dissemination","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Drainage; Drainage basin; Drainage system (geomorphology); Agricultural land","score_opus":0.0176861902512484,"score_gpt":0.32787951455683334,"score_spread":0.31019332430558494,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6926314824","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006659025,0.00011679176,0.000075867145,0.000067480396,0.000023164048,0.0000117789805,0.99739385,0.00010172575,0.0015435234],"genre_scores_gemma":[0.0018819814,0.00018381268,0.00035620783,0.0000369036,0.000009993831,0.00008514278,0.9953603,0.000039744806,0.0020458377],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980824,0.00020930967,0.00035326314,0.00050965964,0.0005609019,0.00028456099],"domain_scores_gemma":[0.9954472,0.0013381358,0.0005113176,0.0006088914,0.0018506927,0.00024368215],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010591313,0.0016461876,0.0011119171,0.008010759,0.00090371276,0.0020490238,0.0015672484,0.0011748659,0.029849393],"category_scores_gemma":[0.009731099,0.00055168406,0.0012815051,0.014848463,0.000520963,0.0013122088,0.0011484645,0.0013961212,0.026760073],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001378032,0.00004745784,0.015814802,0.0022655677,0.00010227653,0.000060969458,0.0002063357,0.00074606825,0.00043561996,0.0013991595,0.96518,0.013603956],"study_design_scores_gemma":[0.000071565606,0.00001298805,0.042615972,0.00047854608,0.000043242046,0.000060289352,0.0003689113,0.00033355883,0.00057873223,0.0005259928,0.9548742,0.00003592695],"about_ca_topic_score_codex":0.2780849,"about_ca_topic_score_gemma":0.43373632,"teacher_disagreement_score":0.7219151,"about_ca_system_score_codex":0.0042595956,"about_ca_system_score_gemma":0.007702587,"threshold_uncertainty_score":0.5529325},"labels":[],"label_agreement":null},{"id":"W6926427096","doi":"10.25384/sage.24905758.v1","title":"sj-docx-1-caj-10.1177_08465371231218240 – Supplemental material for MR Imaging of Pediatric Neuroblastoma: Is Gadolinium Enhancement Necessary for Evaluation of Image-Defined-Risk Factors?","year":2023,"lang":"en","type":"article","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Gadolinium; Magnetic resonance imaging; Medical imaging; Computed tomography","score_opus":0.08079224830060237,"score_gpt":0.3965386499147989,"score_spread":0.31574640161419654,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6926427096","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00025696142,0.000061997656,0.0012888986,0.00074569235,0.00038379754,0.00019032335,0.97859335,0.0061831423,0.012295749],"genre_scores_gemma":[0.0071873073,0.00038800674,0.012717903,0.0017006792,0.0006980905,0.0019650054,0.88859993,0.018132884,0.06861023],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.99866843,0.00018273898,0.00020789514,0.0002501567,0.0005057051,0.00018507423],"domain_scores_gemma":[0.9703781,0.016935738,0.0014966194,0.001959463,0.007562253,0.0016678984],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0023529923,0.0015269774,0.0012138317,0.0042015254,0.0013589975,0.0046097254,0.0030247935,0.0025938633,0.9197547],"category_scores_gemma":[0.03901574,0.0013009357,0.0013822109,0.0042942977,0.0006369487,0.003946055,0.0023689792,0.0018320403,0.68732035],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053850577,0.000022823522,0.00035172986,0.000340879,0.000007658124,0.00001579351,0.000022120093,0.00006322967,0.000054207754,0.00026365428,0.99398583,0.004818196],"study_design_scores_gemma":[0.0004730011,0.000055741097,0.0060549914,0.0010501206,0.00004964278,0.00017615997,0.00032948446,0.0007055786,0.0008990269,0.004892036,0.98521715,0.00009703154],"about_ca_topic_score_codex":0.010662687,"about_ca_topic_score_gemma":0.019417342,"teacher_disagreement_score":0.9197547,"about_ca_system_score_codex":0.001508203,"about_ca_system_score_gemma":0.0031409767,"threshold_uncertainty_score":0.11446023},"labels":[],"label_agreement":null},{"id":"W6929683181","doi":"10.5061/dryad.905qfttvw","title":"Data from: Breeding Ammospiza nelsoni (Nelson’s Sparrow) exploits both saltmarsh and hayfields in northern habitats","year":2024,"lang":"en","type":"dataset","venue":"DRYAD","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Acadia University; Ducks Unlimited Canada; University of New Brunswick","funders":"","keywords":"Nest (protein structural motif); Habitat; Salt marsh; Subspecies; Foraging; Marsh; Bird nest","score_opus":0.11108097452843378,"score_gpt":0.39124108379888706,"score_spread":0.28016010927045326,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6929683181","genre_codex":"empirical","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98041934,0.00005473799,0.0001558151,0.00001662324,0.0000042064216,0.000044007877,0.017327696,0.000018353754,0.0019593027],"genre_scores_gemma":[0.9535738,0.000119909644,0.001352559,0.00005332184,0.000007789253,0.00019975688,0.041243173,0.000010775741,0.0034387403],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.99983644,0.000018612742,0.00002323688,0.000056282264,0.00004658254,0.000018750497],"domain_scores_gemma":[0.9993044,0.00008513042,0.00025202677,0.00006884938,0.0001781787,0.00011128351],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00020979927,0.00021281104,0.00014833664,0.00074446335,0.0004218346,0.00025059428,0.00026701804,0.00011189387,0.002976208],"category_scores_gemma":[0.0004290056,0.000102019774,0.00013152939,0.0006710674,0.00014695148,0.00016596059,0.00028898503,0.00014524053,0.00067466486],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010445071,0.000053984622,0.9849064,0.000048915812,0.00005895075,0.00010846073,0.00031116352,0.00012569063,0.0029503456,0.00002162945,0.0017956233,0.009514464],"study_design_scores_gemma":[0.0000062630884,0.000030136252,0.99739873,0.0000060139982,0.000013770157,0.000038785085,0.00020244076,0.000073701325,0.00024705965,0.0000053690355,0.001974644,0.0000030742726],"about_ca_topic_score_codex":0.09037913,"about_ca_topic_score_gemma":0.39438957,"teacher_disagreement_score":0.09037913,"about_ca_system_score_codex":0.00043322245,"about_ca_system_score_gemma":0.00033767876,"threshold_uncertainty_score":0.1797061},"labels":[],"label_agreement":null},{"id":"W6930394593","doi":"10.5281/zenodo.13860078","title":"Touché21-Argument-Retrieval-for-Comparative-Questions","year":2024,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Optech (Canada)","funders":"","keywords":"Task (project management); Argument (complex analysis); Relation (database); Matching (statistics); Product (mathematics)","score_opus":0.10251390255365318,"score_gpt":0.3832949399999497,"score_spread":0.2807810374462965,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6930394593","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029873002,0.0009359426,0.01913604,0.0015018065,0.00067373284,0.0019472565,0.8881621,0.024978627,0.03279151],"genre_scores_gemma":[0.03677922,0.00011639937,0.023763744,0.00042690113,0.00012666741,0.0052003385,0.91819507,0.00357443,0.011817187],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9947614,0.0016205955,0.0005419097,0.0010895208,0.0015521955,0.00043442464],"domain_scores_gemma":[0.9754262,0.01540466,0.0008138847,0.00485471,0.0024332313,0.0010672394],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003770748,0.0030420823,0.0017961791,0.003957388,0.001941545,0.0027441294,0.002461578,0.005134839,0.13805349],"category_scores_gemma":[0.03987244,0.0009947318,0.0016834443,0.0019422966,0.0009844586,0.005110443,0.00698945,0.0038886818,0.12680301],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001750486,0.0007504524,0.0038989286,0.0020589838,0.00011470824,0.00036084533,0.00094601634,0.0010680722,0.0051846,0.0044154474,0.93010235,0.04934921],"study_design_scores_gemma":[0.0024623517,0.00057680224,0.022818375,0.00045099587,0.00008532185,0.0008624248,0.001110527,0.011626691,0.017322056,0.019405803,0.9230017,0.0002769389],"about_ca_topic_score_codex":0.0043874243,"about_ca_topic_score_gemma":0.007213871,"teacher_disagreement_score":0.13805349,"about_ca_system_score_codex":0.001123665,"about_ca_system_score_gemma":0.001770878,"threshold_uncertainty_score":0.46183497},"labels":[],"label_agreement":null},{"id":"W6930972972","doi":"10.5281/zenodo.3351665","title":"ActiveSwingAsymmetricWalkingIncreaseTrunkKinematicVariability.jl: Supporting code and data for the paper \"Active Arm Swing and Asymmetric Walking Leads to Increased Variability in Trunk Kinematics in Young Adults\"","year":2019,"lang":"en","type":"other","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Kinematics; Foot (prosody); Swing; Trunk; Data file; Installation","score_opus":0.03965435801026159,"score_gpt":0.33552341029296945,"score_spread":0.2958690522827079,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6930972972","genre_codex":"dataset","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004705407,0.0003282564,0.010533784,0.00037472366,0.0009578299,0.00045899974,0.8806202,0.096032515,0.005988276],"genre_scores_gemma":[0.015221407,0.0003533904,0.03586407,0.0008036128,0.00024236187,0.0032390878,0.8300104,0.09544274,0.018822916],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99925417,0.00007323663,0.00007325131,0.00027946892,0.00020007878,0.00011966863],"domain_scores_gemma":[0.99623436,0.0016215856,0.00037780902,0.00078916166,0.00067740626,0.00029977187],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0017361102,0.002805447,0.0018033612,0.0017610346,0.0010077222,0.0029525876,0.0032866362,0.0012321298,0.35529965],"category_scores_gemma":[0.01240371,0.0017430203,0.0034924818,0.001734015,0.0006748475,0.0031431348,0.0036392359,0.002270864,0.25232732],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044103668,0.00006537629,0.0036224376,0.0010860444,0.00011459362,0.000044886165,0.00011312256,0.0003954044,0.0013396561,0.0004888006,0.98111135,0.01117733],"study_design_scores_gemma":[0.0021434322,0.000544458,0.088272095,0.001567098,0.0004988177,0.00063888315,0.00034477373,0.012077417,0.01761542,0.012715976,0.863119,0.00046257247],"about_ca_topic_score_codex":0.0075591113,"about_ca_topic_score_gemma":0.013028801,"teacher_disagreement_score":0.35529965,"about_ca_system_score_codex":0.00075029006,"about_ca_system_score_gemma":0.0020164694,"threshold_uncertainty_score":0.9195868},"labels":[],"label_agreement":null},{"id":"W6950640008","doi":"10.5683/sp3/2o001z","title":"Uneven Lake Ontario. 1:50,000. Map Sheet 052H13, ed. 1, 1969","year":2021,"lang":"en","type":"dataset","venue":"Borealis","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Georeference; General partnership; Natural (archaeology); Aerial photography; Raster graphics; Topographic map (neuroanatomy); Government (linguistics); Geographic information system; Orthophoto","score_opus":0.030244218119805252,"score_gpt":0.3346270523043514,"score_spread":0.30438283418454615,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6950640008","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00010708444,0.000056667846,0.000027218379,0.000028145256,0.000010684516,0.0000062478152,0.9982607,0.00008359675,0.0014196623],"genre_scores_gemma":[0.0006931488,0.00013953303,0.00019708487,0.000021777276,0.000006968551,0.00005464228,0.9938473,0.000082220606,0.0049572154],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99938595,0.00003241598,0.0000501261,0.00015537342,0.00023597585,0.00014007252],"domain_scores_gemma":[0.9984112,0.00012297259,0.0001558435,0.00020948169,0.0009005971,0.00019991322],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00043469245,0.0016508178,0.0011983801,0.004197416,0.00162909,0.0023792756,0.0015314799,0.0005346309,0.10750641],"category_scores_gemma":[0.002897146,0.0007760012,0.00060437754,0.017046148,0.00060934824,0.0009890547,0.0010716476,0.00080630946,0.09218652],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000018460676,0.000003666084,0.00090277306,0.00027275167,0.000008791794,0.000014059193,0.000048847658,0.000058192985,0.000042068572,0.00019452626,0.9958578,0.0025780238],"study_design_scores_gemma":[0.000040603067,0.0000035550133,0.013554573,0.00014448843,0.000011363334,0.000023140425,0.00014571197,0.00007758457,0.00008629699,0.00020851882,0.9856894,0.000014697002],"about_ca_topic_score_codex":0.8432145,"about_ca_topic_score_gemma":0.93287385,"teacher_disagreement_score":0.15678549,"about_ca_system_score_codex":0.007664253,"about_ca_system_score_gemma":0.014258986,"threshold_uncertainty_score":0.35964477},"labels":[],"label_agreement":null},{"id":"W6958119933","doi":"10.6068/dp167a61e00c88","title":"TREND: Federal Housing Finance Agency. House Price Index: House Price Index - Purchase Only | State: Colorado | Metro Name: Denver-Aurora, CO | Seasonally Adjusted: Seasonally Adj, 1991/1 - 2018/3. Data Planet™ Statistical Datasets: A SAGE Publishing Resource Dataset-ID: 057-001-002","year":2018,"lang":"en","type":"other","venue":"Data Planet","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Underwriting; Mortgage insurance; Mortgage underwriting; Index (typography); Loan-to-value ratio; Shared appreciation mortgage; Loan; Quarter (Canadian coin); Securitization","score_opus":0.04806509961095695,"score_gpt":0.3254158836421449,"score_spread":0.27735078403118796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958119933","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00008117749,0.00002166285,0.000027138205,0.000039618517,0.000015999558,0.000007739973,0.9993006,0.0000778916,0.00042814531],"genre_scores_gemma":[0.00030863148,0.000027397777,0.00011688319,0.000029713612,0.000009127259,0.00008108532,0.9985964,0.0000335136,0.0007972744],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99902785,0.00011417047,0.00011329431,0.0003348119,0.00025779285,0.00015205078],"domain_scores_gemma":[0.9969675,0.0002943638,0.00040529258,0.0005500305,0.0015114989,0.00027139278],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008066192,0.0016089313,0.0013256732,0.0027548755,0.0009422303,0.0019701791,0.002650071,0.0015606581,0.08011027],"category_scores_gemma":[0.0051314253,0.00079181406,0.0010233828,0.0063383537,0.00035856463,0.0017107634,0.0015829289,0.0026844328,0.14346607],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019643392,0.000009783271,0.00080123486,0.00014506129,0.00001099261,0.0000046788236,0.0000074772165,0.000064566135,0.000019624516,0.00013922206,0.9977424,0.0010353542],"study_design_scores_gemma":[0.00019215504,0.00001760819,0.011571503,0.0002756426,0.00002656061,0.000029072475,0.00010570327,0.00039315593,0.00020186052,0.0006123126,0.9865455,0.000028868028],"about_ca_topic_score_codex":0.065470345,"about_ca_topic_score_gemma":0.09314974,"teacher_disagreement_score":0.08011027,"about_ca_system_score_codex":0.0019571753,"about_ca_system_score_gemma":0.002751365,"threshold_uncertainty_score":0.26799554},"labels":[],"label_agreement":null},{"id":"W6958345719","doi":"10.6084/m9.figshare.23733064","title":"Additional file 1 of Quality indices for topic model selection and evaluation: a literature review and case study","year":2023,"lang":"en","type":"article","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Selection (genetic algorithm); Topic model; Quality (philosophy); Feature selection; Model selection","score_opus":0.22734455241586826,"score_gpt":0.4993913389751332,"score_spread":0.27204678655926495,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958345719","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00044081535,0.000095803196,0.0016033257,0.00040385325,0.000056300138,0.0007276079,0.9938567,0.0005094326,0.0023060655],"genre_scores_gemma":[0.02554623,0.00096735754,0.0422616,0.0016981232,0.0003070946,0.02666706,0.8708453,0.0026175245,0.029089708],"study_design_codex":"not_applicable","study_design_gemma":"systematic_review","domain_scores_codex":[0.99665713,0.0013028829,0.000784392,0.00042450262,0.0006791112,0.00015199436],"domain_scores_gemma":[0.8015961,0.17458345,0.0051740175,0.0035495732,0.014020258,0.0010766726],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.008924486,0.0009961857,0.0011195589,0.0060683005,0.0009649474,0.002127939,0.002049365,0.0012168383,0.8677206],"category_scores_gemma":[0.13044408,0.00058466883,0.0011378559,0.00787686,0.00037157384,0.0028075338,0.0013316714,0.0011557973,0.14569515],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031030265,0.00010016601,0.001402239,0.009296212,0.000070446295,0.00006250285,0.00019380632,0.0005260039,0.000072374016,0.0012540021,0.96134907,0.025362857],"study_design_scores_gemma":[0.0033692592,0.0003262205,0.015982665,0.012414692,0.00053955405,0.00056163606,0.001370378,0.0030133014,0.00092353224,0.018703599,0.9425899,0.00020521852],"about_ca_topic_score_codex":0.004391765,"about_ca_topic_score_gemma":0.00904374,"teacher_disagreement_score":0.9910755,"about_ca_system_score_codex":0.002000262,"about_ca_system_score_gemma":0.0050993855,"threshold_uncertainty_score":0.18868041},"labels":[],"label_agreement":null},{"id":"W6958687646","doi":"10.6084/m9.figshare.c.7178164.v1","title":"Promoting children’s health through community-led street interventions: analyzing sustained voluntarism in Canadian School Streets","year":2024,"lang":"en","type":"other","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université de Montréal; Queen's University","funders":"","keywords":"Voluntarism (philosophy); Status quo; Charter; Action (physics); Public health; Community organization; Sustainability","score_opus":0.06609306911671098,"score_gpt":0.40736771550850914,"score_spread":0.34127464639179816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958687646","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99676657,0.0001559109,0.0001168513,0.00035899624,0.000009518737,0.00024689152,0.00032762415,0.0000038233247,0.0020138626],"genre_scores_gemma":[0.9977102,0.00024864412,0.00047645363,0.00015903742,0.0000068787913,0.00027740267,0.00024877032,0.0000051841753,0.00086724054],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9955017,0.00085647363,0.00014631417,0.00042752398,0.001247223,0.0018207366],"domain_scores_gemma":[0.992451,0.0012729941,0.0014487248,0.00031871902,0.0026277625,0.0018807849],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0053349603,0.00035034807,0.00054365414,0.0018537103,0.007439744,0.0022517026,0.0018316575,0.00072490866,0.0020409594],"category_scores_gemma":[0.008456127,0.00037991005,0.00065596757,0.0029017862,0.0031376325,0.0006841955,0.0029045884,0.0010020311,0.00011579549],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025680292,0.0006075919,0.7205257,0.00047950065,0.00009969506,0.00041790176,0.22751155,0.00016674999,0.00054835266,0.0012389923,0.0031976774,0.04494946],"study_design_scores_gemma":[0.000022578693,0.00017238018,0.7998113,0.00027419446,0.000035849578,0.00003534127,0.19255681,0.0002899083,0.00012900402,0.00013980517,0.006501129,0.000031698175],"about_ca_topic_score_codex":0.9502279,"about_ca_topic_score_gemma":0.98044854,"teacher_disagreement_score":0.049772084,"about_ca_system_score_codex":0.04567741,"about_ca_system_score_gemma":0.075495414,"threshold_uncertainty_score":0.33141434},"labels":[],"label_agreement":null},{"id":"W6967715341","doi":"10.5281/zenodo.13860035","title":"Touché21-Argument-Retrieval-for-Comparative-Questions","year":2021,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Optech (Canada)","funders":"","keywords":"Task (project management); Argument (complex analysis); Relation (database); Matching (statistics); Product (mathematics)","score_opus":0.10716694945341314,"score_gpt":0.3735980244901535,"score_spread":0.26643107503674035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6967715341","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029736338,0.00096365163,0.019889833,0.0015588693,0.00069811626,0.0019522994,0.88594943,0.026339201,0.03291222],"genre_scores_gemma":[0.03675089,0.00011654656,0.024774827,0.0004284445,0.00012763056,0.0052146143,0.9168983,0.003672232,0.0120165115],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99484813,0.0016248364,0.00051714043,0.0010616898,0.001517414,0.00043077223],"domain_scores_gemma":[0.97602874,0.015068893,0.00078233104,0.0047088927,0.0023523644,0.0010586624],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038093696,0.0030406844,0.0017862193,0.003895431,0.0019176304,0.002752708,0.002455412,0.0050738784,0.1359135],"category_scores_gemma":[0.039768714,0.0009838229,0.0016848479,0.0019323942,0.0009797226,0.00505478,0.007012712,0.0038537304,0.12532891],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017249886,0.00072630163,0.0036301336,0.0019635842,0.000112967144,0.00034310055,0.00089706725,0.0010666484,0.0049676304,0.0043312456,0.93184805,0.048388172],"study_design_scores_gemma":[0.002451285,0.0005647302,0.022088645,0.00044387774,0.000084688894,0.0008313816,0.0010870507,0.012153196,0.01716627,0.01962104,0.9232352,0.00027255883],"about_ca_topic_score_codex":0.00439991,"about_ca_topic_score_gemma":0.0072672586,"teacher_disagreement_score":0.1359135,"about_ca_system_score_codex":0.0011163184,"about_ca_system_score_gemma":0.0017743779,"threshold_uncertainty_score":0.45467597},"labels":[],"label_agreement":null},{"id":"W6967949380","doi":"10.5281/zenodo.12011535","title":"Scarlet Cloak and the Forest Adventure: The Issue of False Positives in AI Detection Tools","year":2024,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Generative grammar; Grammar; False positive paradox; Production (economics); Selection (genetic algorithm); Discipline; Natural language generation; Prototype theory","score_opus":0.02969739178697276,"score_gpt":0.3148960804134628,"score_spread":0.28519868862649,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6967949380","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010936863,0.023231514,0.09429735,0.8292681,0.0058927354,0.000200181,0.00029152966,0.002384764,0.033496995],"genre_scores_gemma":[0.32958427,0.012953408,0.24097557,0.35937798,0.011709712,0.00088949344,0.00034634038,0.0035174477,0.04064582],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.8696675,0.07970145,0.0049074953,0.011678003,0.0326433,0.0014021972],"domain_scores_gemma":[0.2804424,0.6576562,0.011830231,0.02032756,0.027102165,0.0026415212],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15377882,0.0014572116,0.002116653,0.0067555276,0.008316663,0.016479848,0.006111692,0.020953914,0.008756043],"category_scores_gemma":[0.5260125,0.0020793374,0.0014712625,0.0032876034,0.033588994,0.03381523,0.0066490793,0.023705356,0.0056258566],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058742065,0.00015457481,0.015473446,0.0007900279,0.00017532015,0.0025140997,0.021132467,0.0020031473,0.0011739705,0.2091831,0.32835624,0.41845623],"study_design_scores_gemma":[0.0002236581,0.000258666,0.0053986283,0.0032229412,0.00018164939,0.006546316,0.0079387855,0.016232084,0.004948849,0.574902,0.37963086,0.0005155471],"about_ca_topic_score_codex":0.012740018,"about_ca_topic_score_gemma":0.011864262,"teacher_disagreement_score":0.15377882,"about_ca_system_score_codex":0.00476627,"about_ca_system_score_gemma":0.0050909733,"threshold_uncertainty_score":0.81326985},"labels":[],"label_agreement":null},{"id":"W6967989515","doi":"10.5281/zenodo.11077480","title":"FR.POL.GEN: A repository for textual analysis of all 'general policy speeches' from the Fifth French Republic.","year":2024,"lang":"fr","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Scripting language; Annotation; Natural language; Knowledge base; Natural (archaeology); Digital humanities","score_opus":0.07004695761329054,"score_gpt":0.3470227756223349,"score_spread":0.27697581800904436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6967989515","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042547486,0.00058028835,0.011286547,0.00024436775,0.00010167187,0.000114209346,0.94869447,0.021941733,0.012781963],"genre_scores_gemma":[0.011247059,0.00045419938,0.013889584,0.00008169232,0.000045412376,0.00038432895,0.96005726,0.005061626,0.008778787],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989649,0.00029660002,0.00014360144,0.0002105497,0.00030603408,0.00007829277],"domain_scores_gemma":[0.9962373,0.0018432718,0.00033411846,0.0006627544,0.0007897229,0.00013278089],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011097176,0.0013973583,0.0007073969,0.0072592306,0.0007064123,0.0017034765,0.000905868,0.00091874273,0.082270846],"category_scores_gemma":[0.0059488467,0.00074183947,0.0005724658,0.0061828555,0.00045346117,0.0018163371,0.0012582307,0.0008198044,0.05841601],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004759248,0.000066869834,0.004444511,0.0035591982,0.00009830016,0.00072076713,0.0025858674,0.0012407583,0.00933357,0.0051443283,0.8044886,0.16784127],"study_design_scores_gemma":[0.000054964938,0.000031043943,0.0092524,0.00028086398,0.00003081158,0.00038752911,0.00065078243,0.0011695287,0.0042081657,0.0015734696,0.98229915,0.00006129414],"about_ca_topic_score_codex":0.019238887,"about_ca_topic_score_gemma":0.020930635,"teacher_disagreement_score":0.082270846,"about_ca_system_score_codex":0.0012562776,"about_ca_system_score_gemma":0.00232754,"threshold_uncertainty_score":0.27522337},"labels":[],"label_agreement":null},{"id":"W6968556807","doi":"10.5281/zenodo.3626813","title":"A Workflow Analysis Perspective to Scholarly Research Tasks - Auxiliary materials","year":2020,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Nederlandse Organisatie voor Wetenschappelijk Onderzoek","keywords":"Workflow; Perspective (graphical); Ontology; Domain (mathematical analysis); Interview; Coding (social sciences)","score_opus":0.13609475359771903,"score_gpt":0.38590773434839876,"score_spread":0.24981298075067973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6968556807","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005425652,0.0030597032,0.8073228,0.035699204,0.001151349,0.0014317281,0.0027688153,0.0013629432,0.14177772],"genre_scores_gemma":[0.1075655,0.008193135,0.7862178,0.0039609703,0.0014895926,0.0036316062,0.008497335,0.0026375838,0.07780652],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.98305595,0.010984548,0.0012430089,0.0011348485,0.0027464265,0.00083516876],"domain_scores_gemma":[0.96045935,0.026565032,0.0014694787,0.0041779387,0.0056052776,0.0017230205],"candidate_categories":["metaresearch","scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.020811995,0.0014496587,0.0007621138,0.009183578,0.0058103222,0.021881197,0.0031399585,0.0030230957,0.03209338],"category_scores_gemma":[0.027730882,0.00103268,0.0018858325,0.0145246405,0.008717593,0.022360262,0.0058190324,0.005013975,0.009597601],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000046733458,0.00009696677,0.0004096849,0.00077300315,0.000013084858,0.00021604652,0.014949658,0.001226945,0.0008621825,0.8825559,0.02959516,0.06925452],"study_design_scores_gemma":[0.000023772945,0.000030467914,0.0006094327,0.0014910882,0.000015763808,0.00026088825,0.01522099,0.0033196642,0.0014454598,0.4027277,0.5748121,0.000042570806],"about_ca_topic_score_codex":0.010542787,"about_ca_topic_score_gemma":0.0081401635,"teacher_disagreement_score":0.979188,"about_ca_system_score_codex":0.010912858,"about_ca_system_score_gemma":0.017450012,"threshold_uncertainty_score":0.11006564},"labels":[],"label_agreement":null},{"id":"W6969213048","doi":"10.5281/zenodo.4247625","title":"The retrospective review theological education of Moldova","year":2020,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cytodiagnostics (Canada)","funders":"","keywords":"Complementarity (molecular biology); Formative assessment; Religious education; Process (computing); Human relations; Spirituality","score_opus":0.05662047267867431,"score_gpt":0.41690948919485593,"score_spread":0.3602890165161816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6969213048","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.097712256,0.8737263,0.00033492642,0.0015541392,0.00075754256,0.00034780437,0.011017218,0.00003096764,0.01451879],"genre_scores_gemma":[0.2880028,0.6985746,0.0006612813,0.0011880308,0.00053952186,0.0005051228,0.006513185,0.000051648218,0.0039638435],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99813336,0.0005150427,0.0005788241,0.00024393508,0.00033039085,0.00019833747],"domain_scores_gemma":[0.9967476,0.0010663045,0.0013204783,0.00020578317,0.00050036586,0.00015944178],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015106946,0.00037308788,0.0009326888,0.011755807,0.0009909072,0.0018380274,0.0009016598,0.0005901142,0.0057607163],"category_scores_gemma":[0.0063392282,0.00044299904,0.00053622655,0.02021091,0.0011364471,0.0012801863,0.0013896868,0.0005950218,0.0010610451],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064577744,0.00017874746,0.1880911,0.15766959,0.0008025227,0.014749571,0.02238941,0.0003237606,0.0018683411,0.013184426,0.06931462,0.5307821],"study_design_scores_gemma":[0.000027209608,0.00012551753,0.2505192,0.07500125,0.0006075495,0.012375375,0.01738238,0.00004153673,0.00059758814,0.00043965917,0.6428368,0.000046033216],"about_ca_topic_score_codex":0.01873713,"about_ca_topic_score_gemma":0.03210015,"teacher_disagreement_score":0.01873713,"about_ca_system_score_codex":0.0027019433,"about_ca_system_score_gemma":0.006874256,"threshold_uncertainty_score":0.03725612},"labels":[],"label_agreement":null},{"id":"W6969375112","doi":"10.5281/zenodo.7998351","title":"Known Items and Narrow Topics: What Queries Say About Data Search Strategies","year":2023,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for Public Safety Research and Treatment","funders":"","keywords":"Exploratory search; Semantic search; Identifier; Search engine; Phrase search; Search analytics; Keyword search; Web search query","score_opus":0.12674120967786157,"score_gpt":0.371176084487303,"score_spread":0.24443487480944143,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6969375112","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9318636,0.012266363,0.018344926,0.010357747,0.00013837387,0.00034758833,0.005781962,0.0005057354,0.020393679],"genre_scores_gemma":[0.98634446,0.0022669989,0.005536136,0.0019788104,0.00014092703,0.00018940365,0.0024293633,0.00021375493,0.00090013334],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9866773,0.0070085526,0.0019757797,0.0013942785,0.0020218433,0.0009222932],"domain_scores_gemma":[0.84296554,0.13522021,0.009199109,0.003372088,0.007140481,0.0021026288],"candidate_categories":["metaresearch","scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.013126601,0.00049710216,0.000905224,0.006755393,0.0011889526,0.007237966,0.0009285211,0.0023454262,0.0021514907],"category_scores_gemma":[0.13345762,0.0004521389,0.0008425938,0.005308485,0.002126444,0.017379751,0.0027321945,0.0013790592,0.0011529548],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016041424,0.00021856237,0.61071235,0.0037289427,0.00034386505,0.0006433064,0.16724765,0.00082092464,0.0063204495,0.01129828,0.016681071,0.18038051],"study_design_scores_gemma":[0.00015713199,0.00062215514,0.56267786,0.0029306456,0.00052064925,0.0037798148,0.29426357,0.010153732,0.0040367423,0.032381777,0.0880326,0.0004433031],"about_ca_topic_score_codex":0.008866233,"about_ca_topic_score_gemma":0.0059734797,"teacher_disagreement_score":0.992762,"about_ca_system_score_codex":0.0018675801,"about_ca_system_score_gemma":0.001418876,"threshold_uncertainty_score":0.06942093},"labels":[],"label_agreement":null},{"id":"W6976840131","doi":"10.6082/uchicago.6033","title":"Is the News Always Negative? Using Deep Learning to Track News Sentiment During the Covid-19 Pandemic","year":2023,"lang":"en","type":"article","venue":"Knowledge@UChicago (University of Chicago)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"News media; Politics; Pandemic; News values; Coronavirus disease 2019 (COVID-19); Topic model; News analytics; Focus (optics); Sentiment analysis","score_opus":0.08298298068602979,"score_gpt":0.35616097180176476,"score_spread":0.273177991115735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6976840131","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9584319,0.002744487,0.015002779,0.0037353202,0.0007444805,0.0000615992,0.0057185213,0.0007581096,0.0128026875],"genre_scores_gemma":[0.9866045,0.0005666394,0.003355571,0.00040734303,0.000352452,0.000019070609,0.005722981,0.000039843337,0.0029316198],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99968636,0.000077185694,0.000024611327,0.000089271634,0.000050307564,0.000072195704],"domain_scores_gemma":[0.99854845,0.00066053943,0.00033211603,0.00006998247,0.00028099844,0.00010789809],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007724318,0.00059609895,0.00032106013,0.0016656338,0.00025701892,0.0015775003,0.0003304336,0.0006028736,0.0010819832],"category_scores_gemma":[0.0040515894,0.00019701007,0.0003350919,0.0009290746,0.00022573271,0.0014065271,0.00049150933,0.0010523434,0.00106055],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001324079,0.0005299739,0.5456056,0.00046647977,0.00056515104,0.0010427274,0.0012618831,0.039001297,0.013815686,0.0017696401,0.058685005,0.33593243],"study_design_scores_gemma":[0.000056187335,0.00018841636,0.12570603,0.00015505271,0.00017057521,0.00021942183,0.0011608986,0.85049766,0.0042764232,0.0034369908,0.014070619,0.000061722894],"about_ca_topic_score_codex":0.011095597,"about_ca_topic_score_gemma":0.018175488,"teacher_disagreement_score":0.011095597,"about_ca_system_score_codex":0.0005834853,"about_ca_system_score_gemma":0.0004984337,"threshold_uncertainty_score":0.022062004},"labels":[],"label_agreement":null},{"id":"W6979255470","doi":"","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","year":2025,"lang":"en","type":"article","venue":"ArXiv.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Ambiguity; Embedding; Transformation (genetics); Software deployment; Raising (metalworking); Sentence","score_opus":0.5209298266243385,"score_gpt":0.5210722438492991,"score_spread":0.00014241722496055598,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6979255470","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03375255,0.0007923681,0.9549854,0.0012431366,0.00012102853,0.0002965786,0.0005752976,0.000792297,0.007441335],"genre_scores_gemma":[0.58443505,0.0003534028,0.41076195,0.00057492737,0.0002128457,0.0011747177,0.0007839619,0.00054464367,0.0011585543],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.92124516,0.057092164,0.0038213248,0.005300236,0.01156698,0.0009740615],"domain_scores_gemma":[0.7094587,0.23020372,0.01929943,0.022789974,0.01657455,0.0016735417],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07647264,0.0017758632,0.0014054198,0.009701048,0.0023032553,0.0065032835,0.0027955116,0.002927982,0.0063092564],"category_scores_gemma":[0.33978346,0.0006238995,0.001657478,0.0058504343,0.0070176544,0.012981421,0.008198344,0.003428126,0.0010328655],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006872625,0.00021011257,0.045347538,0.0012631544,0.0009073847,0.00027719722,0.0075095706,0.07705778,0.00512023,0.559534,0.005769806,0.296316],"study_design_scores_gemma":[0.00007269299,0.00041313237,0.00854482,0.0005273305,0.00019024168,0.00025620384,0.0017689009,0.26669312,0.005056354,0.705535,0.010761401,0.00018087495],"about_ca_topic_score_codex":0.0021449223,"about_ca_topic_score_gemma":0.002677603,"teacher_disagreement_score":0.07647264,"about_ca_system_score_codex":0.0031841008,"about_ca_system_score_gemma":0.0031755508,"threshold_uncertainty_score":0.4044308},"labels":[],"label_agreement":null},{"id":"W6979264087","doi":"","title":"Testing Hypotheses of Covariate Effects on Topics of Discourse","year":2025,"lang":"en","type":"article","venue":"ArXiv.org","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Covariate; Resampling; Contrast (vision); Bayesian probability; Generative grammar; Probabilistic logic; Generative model; Statistical model; Regression","score_opus":0.11590743890700207,"score_gpt":0.4131701359881618,"score_spread":0.29726269708115977,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6979264087","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17294915,0.00073444366,0.8169293,0.0021387015,0.00009323122,0.00034590147,0.0017738325,0.00075570744,0.004279674],"genre_scores_gemma":[0.8419582,0.0003829698,0.15170093,0.00032129398,0.00029244612,0.0008169153,0.0023240913,0.000233063,0.0019700797],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98403305,0.010763002,0.00049431395,0.0033074897,0.0010669496,0.00033521486],"domain_scores_gemma":[0.75354743,0.22343628,0.008168768,0.010809303,0.0025983031,0.0014399379],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023875302,0.0009219666,0.00131527,0.0019015027,0.0015768793,0.0038305072,0.0018991847,0.0020564348,0.0074490383],"category_scores_gemma":[0.18286031,0.0006105627,0.0016958565,0.0022711158,0.0031656977,0.0054472,0.003374819,0.0027936778,0.0012906042],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0033730452,0.0010227726,0.15137975,0.0013921411,0.0011673291,0.0010019416,0.017897403,0.051195934,0.017957838,0.3975437,0.006742148,0.34932595],"study_design_scores_gemma":[0.0002218466,0.0008940899,0.07044842,0.0002945542,0.00042650374,0.0004805561,0.0022694115,0.32008764,0.00874552,0.57495165,0.020997515,0.00018235833],"about_ca_topic_score_codex":0.0029886926,"about_ca_topic_score_gemma":0.002229339,"teacher_disagreement_score":0.023875302,"about_ca_system_score_codex":0.0014055215,"about_ca_system_score_gemma":0.0016962715,"threshold_uncertainty_score":0.12626612},"labels":[],"label_agreement":null},{"id":"W6980762393","doi":"","title":"Cooperation between IODE and JCOMM through ETDMP and the JCOMM DMPA","year":2009,"lang":"en","type":"other","venue":"AquaDocs  (United Nations Educational, Scientific and Cultural Organization)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"UNESCO Institute for Statistics","funders":"","keywords":"Population; Work (physics); Field (mathematics); Phase (matter)","score_opus":0.02893579201420957,"score_gpt":0.3407664284696458,"score_spread":0.3118306364554362,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6980762393","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016495986,0.004954031,0.06391471,0.110264726,0.011964674,0.001330994,0.011371937,0.0040702242,0.7756327],"genre_scores_gemma":[0.0941653,0.0028537794,0.089992985,0.02502306,0.0030081442,0.0014460629,0.012565458,0.0054297224,0.7655155],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9856355,0.0036717295,0.0006819215,0.0010608964,0.006254185,0.0026955951],"domain_scores_gemma":[0.9265209,0.011119023,0.002301595,0.010211955,0.03466292,0.015183668],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02548716,0.00070930296,0.0007787554,0.0050193896,0.003967929,0.009329243,0.0027911311,0.0031611354,0.07858221],"category_scores_gemma":[0.046656385,0.00049356144,0.0006356055,0.00531374,0.002126968,0.005754719,0.01024204,0.0051415716,0.02287167],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004477549,0.0003215352,0.004631204,0.0004623067,0.00006523917,0.0005984579,0.0020732598,0.00097296084,0.0036440808,0.11179853,0.6612892,0.21369544],"study_design_scores_gemma":[0.000014476082,0.0000104944365,0.0009769477,0.000065707,0.0000043248992,0.00007691816,0.00029802063,0.00040898658,0.00068735,0.0024832208,0.99496233,0.000011050128],"about_ca_topic_score_codex":0.034533467,"about_ca_topic_score_gemma":0.02492465,"teacher_disagreement_score":0.07858221,"about_ca_system_score_codex":0.009002251,"about_ca_system_score_gemma":0.049720045,"threshold_uncertainty_score":0.26288366},"labels":[],"label_agreement":null},{"id":"W6981022659","doi":"","title":"Development of a DNA vaccine against Renibacterium salmoninarum in Atlantic salmon (Salmo salar)","year":2000,"lang":"en","type":"other","venue":"Library and Archives Canada (Government of Canada)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"DNA vaccination; Virulence; Pathogenicity; Immune system; Strain (injury); Serotype; Aquatic animal","score_opus":0.0061933913840717635,"score_gpt":0.19838933172335518,"score_spread":0.19219594033928342,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6981022659","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9681276,0.001825794,0.019468818,0.0011017217,0.0003872194,0.0009670359,0.001816712,0.00056691846,0.00573814],"genre_scores_gemma":[0.93439204,0.00247807,0.035466965,0.00075377047,0.000055193774,0.00041888462,0.006206349,0.0000715268,0.020157102],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9998254,0.000026201942,0.000010439652,0.00003773515,0.00005733021,0.000042858203],"domain_scores_gemma":[0.99986684,0.000022089607,0.000018578708,0.000010617829,0.000054423068,0.00002738185],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00039823848,0.00046772888,0.0003470195,0.00032573473,0.00027927404,0.00046865272,0.00044987665,0.0006077584,0.0022851285],"category_scores_gemma":[0.00033142362,0.00016597293,0.00042716617,0.0001625793,0.00025130296,0.00018679752,0.0002815266,0.00074593624,0.0007710661],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036557677,0.0005025124,0.0010818221,0.00016132611,0.000029471656,0.00007270907,0.000047132147,0.0007909388,0.9601087,0.00026631326,0.0013449236,0.035228554],"study_design_scores_gemma":[0.00086740503,0.013155367,0.013796208,0.00005973074,0.00025667675,0.00034830385,0.00026426217,0.008306308,0.9333768,0.00035160556,0.029191947,0.000025307294],"about_ca_topic_score_codex":0.010465367,"about_ca_topic_score_gemma":0.013823218,"teacher_disagreement_score":0.010465367,"about_ca_system_score_codex":0.0007673128,"about_ca_system_score_gemma":0.0014737339,"threshold_uncertainty_score":0.020808876},"labels":[],"label_agreement":null},{"id":"W6982530285","doi":"","title":"Inuit Cribbage Board","year":2020,"lang":"en","type":"article","venue":"Digital Kenyon (Kenyon College)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"TSG101; Circumstantial evidence; Population; Ridiculous; Dingo","score_opus":0.0418712040573743,"score_gpt":0.31777272537269136,"score_spread":0.27590152131531703,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6982530285","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34211075,0.0010346343,0.0017916858,0.0017566714,0.0007396299,0.00028701685,0.0024536876,0.00045365572,0.6493722],"genre_scores_gemma":[0.42210397,0.00078305835,0.002216006,0.0008148966,0.000057202502,0.00012627922,0.0023575418,0.00033143593,0.5712096],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996612,0.000024503166,0.000013084267,0.00011126815,0.000070195885,0.00011976819],"domain_scores_gemma":[0.9996877,0.000022685852,0.000024945823,0.000031503692,0.0000920238,0.00014128716],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00029836153,0.0006257682,0.00028452772,0.00090792327,0.008466661,0.002559647,0.0010163641,0.00078393205,0.13482957],"category_scores_gemma":[0.0007503129,0.0003646502,0.00030761224,0.0010711622,0.00087650435,0.0020170365,0.0021018952,0.0010035669,0.0152997365],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078586565,0.0007218819,0.07534232,0.0011608828,0.00006150728,0.015626913,0.14032601,0.00021840597,0.016564518,0.06337171,0.35827345,0.32754654],"study_design_scores_gemma":[0.000012999673,0.00018653921,0.05479917,0.00026014601,0.000030041458,0.0030955714,0.05901337,0.00029226526,0.0015463982,0.0008184839,0.87989783,0.000047242287],"about_ca_topic_score_codex":0.19265644,"about_ca_topic_score_gemma":0.51786697,"teacher_disagreement_score":0.19265644,"about_ca_system_score_codex":0.0024881754,"about_ca_system_score_gemma":0.0021174569,"threshold_uncertainty_score":0.4510498},"labels":[],"label_agreement":null},{"id":"W6983987095","doi":"","title":"Inside Cover","year":2007,"lang":"en","type":"article","venue":"Archivaria","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"","score_opus":0.038844752549559984,"score_gpt":0.3892369618097813,"score_spread":0.3503922092602213,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6983987095","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00053395645,0.00036423386,0.0016198581,0.000715424,0.0016130166,0.0000949121,0.0031967638,0.002570364,0.9892915],"genre_scores_gemma":[0.0016886828,0.00018494263,0.0005014501,0.00023274671,0.00038550078,0.000041583706,0.001690248,0.0012461473,0.9940287],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.999537,0.00004713478,0.000015734753,0.000097248885,0.00023328928,0.00006966388],"domain_scores_gemma":[0.998497,0.00026665413,0.00007059083,0.0003884474,0.00037546022,0.00040189066],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.00032728212,0.0010988273,0.0009544983,0.0025174003,0.0018836467,0.0045962213,0.0011484256,0.0015916176,0.91290766],"category_scores_gemma":[0.0027578885,0.00048495628,0.0007925342,0.0022089162,0.0005079734,0.0036908956,0.003699777,0.0015765175,0.8684365],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000031061747,0.000029137014,0.000102938866,0.00010326836,0.0000025279103,0.00005444238,0.000069887734,0.000050947016,0.00054586853,0.0030932184,0.8734952,0.12242143],"study_design_scores_gemma":[0.0000041286767,0.0000074859486,0.0002214113,0.000041729105,0.0000018346803,0.000046558354,0.000049967166,0.000070001704,0.00016222853,0.0013027437,0.9980877,0.0000041111534],"about_ca_topic_score_codex":0.0010111333,"about_ca_topic_score_gemma":0.0029815743,"teacher_disagreement_score":0.08709234,"about_ca_system_score_codex":0.00053688115,"about_ca_system_score_gemma":0.0008136763,"threshold_uncertainty_score":0.12422663},"labels":[],"label_agreement":null},{"id":"W6984660992","doi":"","title":"Ramabai Espinet","year":2014,"lang":"es","type":"other","venue":"University of Minnesota Digital Conservancy (University of Minnesota)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Period (music); Population; Immigration; Polynesians","score_opus":0.016632722793998144,"score_gpt":0.23542162413784187,"score_spread":0.21878890134384374,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6984660992","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008587361,0.007427335,0.00075559516,0.012159687,0.0023060918,0.000053236603,0.0012094879,0.0008869764,0.96661425],"genre_scores_gemma":[0.039744265,0.0048172176,0.0012620748,0.0018792265,0.00032564707,0.00004567174,0.00060462026,0.00034759677,0.95097363],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99931633,0.00008905113,0.000024447478,0.00012906459,0.00033617116,0.00010497972],"domain_scores_gemma":[0.9979062,0.00039966137,0.00009671603,0.0001242677,0.0011060392,0.00036708094],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0009309745,0.0005305793,0.00033784268,0.0012225687,0.0037882708,0.0031356167,0.0004883945,0.0007892746,0.13623098],"category_scores_gemma":[0.004584092,0.0001818913,0.00011229608,0.0015591311,0.00072482886,0.0015610274,0.0010930982,0.0015155474,0.03959373],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000089060595,0.000040385396,0.0013392109,0.0002638593,0.0000036719089,0.0006013377,0.005407301,0.000038716666,0.0007840939,0.017376699,0.70586646,0.26818925],"study_design_scores_gemma":[0.000002864611,0.00000473978,0.0010579885,0.000082597006,0.0000014613696,0.00024096924,0.0013830588,0.000038445036,0.00021794412,0.00048312757,0.9964813,0.000005554608],"about_ca_topic_score_codex":0.026957253,"about_ca_topic_score_gemma":0.077730216,"teacher_disagreement_score":0.86376905,"about_ca_system_score_codex":0.0015723379,"about_ca_system_score_gemma":0.003626753,"threshold_uncertainty_score":0.455738},"labels":[],"label_agreement":null},{"id":"W6989705708","doi":"","title":"Canadian Solar Ranked #1 in Energy on Newsweek's 2024 World's Trustworthy Companies List","year":2024,"lang":"en","type":"other","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Trustworthiness; Solar energy; Energy (signal processing); Government (linguistics); Outsourcing","score_opus":0.024287623746931403,"score_gpt":0.33184361057115075,"score_spread":0.30755598682421936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6989705708","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0053626965,0.002168075,0.00035071318,0.027303148,0.008228182,0.00016710318,0.15207963,0.0021268157,0.80221355],"genre_scores_gemma":[0.012397037,0.0017132516,0.00056727143,0.0025601806,0.0007022033,0.00003087129,0.028457576,0.00048260367,0.9530891],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980878,0.00002707406,0.000030278079,0.00006998408,0.0014188067,0.00036595992],"domain_scores_gemma":[0.99336064,0.00020963722,0.000106799314,0.00010763674,0.004248497,0.0019667123],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0008107461,0.0011837223,0.00079032034,0.0059072063,0.0073649087,0.00779654,0.0011570195,0.002110504,0.32199588],"category_scores_gemma":[0.0046091806,0.00037470346,0.0007364064,0.008148969,0.00078196236,0.0014855051,0.0012481124,0.0020184298,0.12347842],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000011271263,0.0000053562417,0.00030420325,0.000023545317,0.000001862919,0.00001572485,0.000011128162,0.000020442385,0.00003584621,0.00068014686,0.9934974,0.005393019],"study_design_scores_gemma":[0.000014738615,0.000009654285,0.006010984,0.00004291729,0.000009050137,0.000020219015,0.00027440395,0.00014201095,0.0002816436,0.00041905823,0.99275416,0.000021041278],"about_ca_topic_score_codex":0.92746884,"about_ca_topic_score_gemma":0.9803783,"teacher_disagreement_score":0.32199588,"about_ca_system_score_codex":0.019523265,"about_ca_system_score_gemma":0.053589143,"threshold_uncertainty_score":0.9670906},"labels":[],"label_agreement":null},{"id":"W6991887935","doi":"","title":"Investorideas.com - 2017 Ontario Sustainable Energy Association","year":2017,"lang":"en","type":"other","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Sustainability; Government (linguistics); Sustainable energy; Sustainable development; Energy (signal processing)","score_opus":0.032774782084135076,"score_gpt":0.3377377057893126,"score_spread":0.3049629237051775,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6991887935","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007166036,0.0013036607,0.006328572,0.007223614,0.0009750178,0.000121573474,0.051522013,0.0063133207,0.9254957],"genre_scores_gemma":[0.0029619213,0.001227221,0.0031144493,0.00043768782,0.00016804822,0.0000757668,0.021776892,0.003093413,0.9671446],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989097,0.00008094509,0.000044422275,0.0001436942,0.00069636933,0.00012480846],"domain_scores_gemma":[0.99630475,0.00057760614,0.00017130029,0.00060459215,0.0015072449,0.00083454885],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0015005571,0.0011748704,0.00072499196,0.003334282,0.00214292,0.0074829855,0.0016763828,0.0017172357,0.68259555],"category_scores_gemma":[0.007184459,0.00056593766,0.00062346586,0.0045446297,0.0013012759,0.003827511,0.0035386544,0.0017869719,0.49168515],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025188518,0.000021879885,0.00039621964,0.00010066543,0.0000058857077,0.000024286965,0.000047175577,0.00012423481,0.00012640706,0.007947226,0.9138043,0.07737653],"study_design_scores_gemma":[0.000004207245,0.0000018038004,0.0003851797,0.00004483036,0.0000017344382,0.000009603589,0.000045678735,0.00032322644,0.00013401153,0.003066778,0.9959777,0.000005230836],"about_ca_topic_score_codex":0.144939,"about_ca_topic_score_gemma":0.29237646,"teacher_disagreement_score":0.855061,"about_ca_system_score_codex":0.005441045,"about_ca_system_score_gemma":0.00986242,"threshold_uncertainty_score":0.45273888},"labels":[],"label_agreement":null},{"id":"W7015771415","doi":"","title":"Topic modelling of Far-right Canadians’ tweets on COVID-19","year":2022,"lang":"en","type":"article","venue":"York University Digital Library (York University)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Topic model; Python (programming language); Social media; Pandemic; The Internet","score_opus":0.04418445289405444,"score_gpt":0.22781790060736734,"score_spread":0.18363344771331291,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7015771415","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9337965,0.0011491424,0.033505466,0.0030145976,0.00012928377,0.00021935334,0.012041835,0.00036142665,0.015782375],"genre_scores_gemma":[0.9824159,0.0003055569,0.0072718323,0.00009765653,0.00005931614,0.00008909936,0.0060954574,0.00005283123,0.0036123379],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9993837,0.00018360013,0.000023568486,0.00013149208,0.00012776873,0.00014984878],"domain_scores_gemma":[0.9972439,0.0020373573,0.00016598101,0.00008454897,0.0003650177,0.00010333483],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001759539,0.00049220276,0.0003579333,0.0015614213,0.0013221458,0.002323232,0.00064467965,0.0006115513,0.0026941653],"category_scores_gemma":[0.0065232688,0.00021765067,0.00052172627,0.0023367496,0.0005580048,0.001144125,0.0006439025,0.0010861006,0.00066640024],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022797054,0.00047622225,0.45168278,0.0013418375,0.0005735501,0.0017769354,0.04442533,0.19573924,0.013354893,0.07985638,0.060255732,0.14823747],"study_design_scores_gemma":[0.000058432204,0.0000611945,0.16255482,0.00021869144,0.00013675433,0.00019096555,0.016079718,0.7670558,0.0025564537,0.011544888,0.039415635,0.00012664049],"about_ca_topic_score_codex":0.54007894,"about_ca_topic_score_gemma":0.49228013,"teacher_disagreement_score":0.45992106,"about_ca_system_score_codex":0.0036187202,"about_ca_system_score_gemma":0.0038018692,"threshold_uncertainty_score":0.92525923},"labels":[],"label_agreement":null},{"id":"W7017567771","doi":"","title":"Audit algorithmique de la plateforme numérique Google Actualités : la part des médias locaux et régionaux québécois dans les résultats de recherche d'août à décembre 2021","year":2023,"lang":"fr","type":"other","venue":"Archipelago (Université du Québec à Montréal)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Context (archaeology); National library; Lafora disease; Newspaper","score_opus":0.06675856435807097,"score_gpt":0.3176520309202654,"score_spread":0.2508934665621944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7017567771","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.41380328,0.0062855245,0.42450592,0.0036861082,0.0019030094,0.0015911077,0.039967373,0.05239411,0.055863515],"genre_scores_gemma":[0.5823004,0.0015002621,0.34535527,0.00039713067,0.00021881062,0.0009764654,0.036170825,0.0032483307,0.029832555],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99420667,0.0008736348,0.00055436516,0.0009982953,0.0029451465,0.00042191902],"domain_scores_gemma":[0.9840284,0.006092631,0.00079066254,0.0014465009,0.0074062715,0.00023552203],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004363505,0.0014246723,0.0010664389,0.00761546,0.0017124532,0.005617615,0.0016145717,0.0011486964,0.00614684],"category_scores_gemma":[0.033506304,0.00062903424,0.0009992932,0.006566482,0.0012854077,0.0027625207,0.0016070205,0.0014134275,0.0047649313],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012225236,0.00016542156,0.101923995,0.0018136619,0.00042944422,0.0005586157,0.0028706098,0.054225773,0.014865943,0.01337491,0.08166078,0.72688836],"study_design_scores_gemma":[0.0002855875,0.00026125283,0.08601306,0.0008282665,0.0003865602,0.0010217455,0.004235068,0.67376465,0.046600606,0.0152808465,0.17102498,0.0002973452],"about_ca_topic_score_codex":0.17213239,"about_ca_topic_score_gemma":0.21434216,"teacher_disagreement_score":0.8278676,"about_ca_system_score_codex":0.0032623394,"about_ca_system_score_gemma":0.0066717183,"threshold_uncertainty_score":0.3422609},"labels":[],"label_agreement":null},{"id":"W7024405990","doi":"","title":"Social science perspectives on managing agricultural technology","year":2017,"lang":"en","type":"article","venue":"AgEcon Search (University of Minnesota, USA)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Instituto Nacional de Investigaciones Agropecuarias; Indian Council of Agricultural Research; International Development Research Centre","keywords":"Work (physics); Agriculture; Field (mathematics); Agricultural communication; Agricultural machinery; Social research; Agricultural productivity","score_opus":0.05254972551088515,"score_gpt":0.36288531893114295,"score_spread":0.3103355934202578,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7024405990","genre_codex":"other","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.30888346,0.0055051637,0.009880942,0.18482055,0.00052037806,0.00010028583,0.00012507774,0.00003425402,0.4901298],"genre_scores_gemma":[0.9841687,0.0016962633,0.0008635899,0.0027852948,0.00016838302,0.000041531548,0.000025981355,0.000023677621,0.010226611],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9854122,0.011524701,0.00016220966,0.00044219784,0.00086423877,0.0015944139],"domain_scores_gemma":[0.988593,0.008917192,0.0008806452,0.000234146,0.0004720772,0.00090285664],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012587053,0.0005197894,0.0003236089,0.0025651546,0.015604999,0.016252687,0.0013586087,0.005503689,0.0049955295],"category_scores_gemma":[0.0095036235,0.00025878986,0.00037471077,0.0035359433,0.031931944,0.0111972485,0.0072224718,0.004381278,0.00044105592],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000045063633,0.00007337759,0.0024053669,0.00012593278,0.000024073666,0.0016736729,0.4572041,0.0011774906,0.0006070939,0.5102086,0.010052082,0.016403126],"study_design_scores_gemma":[0.000015218137,0.000052433148,0.0024655254,0.0001751541,0.0000125446295,0.000291033,0.52126235,0.00095166854,0.00039567918,0.14234847,0.3319988,0.000031155243],"about_ca_topic_score_codex":0.0088031255,"about_ca_topic_score_gemma":0.012816176,"teacher_disagreement_score":0.016252687,"about_ca_system_score_codex":0.010511555,"about_ca_system_score_gemma":0.0044068275,"threshold_uncertainty_score":0.07626706},"labels":[],"label_agreement":null},{"id":"W7024616234","doi":"","title":"Scott to seek re-election in Toronto-Danforth","year":2015,"lang":"en","type":"article","venue":"eYLS (Yale Law School)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"","score_opus":0.03886465314485646,"score_gpt":0.357186632685522,"score_spread":0.31832197954066555,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7024616234","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12745658,0.0032674544,0.001614322,0.33293104,0.006844367,0.00017522222,0.00093804405,0.00013186604,0.5266412],"genre_scores_gemma":[0.33978826,0.00047516584,0.000271624,0.03631156,0.00025156778,0.00004029443,0.00013893661,0.00008605209,0.6226366],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9969881,0.00043097715,0.000059165028,0.00035979282,0.00046853765,0.0016934084],"domain_scores_gemma":[0.99820495,0.0005117509,0.00006990318,0.00009813729,0.00030500733,0.0008102622],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020946506,0.00031492097,0.00040594724,0.00046005347,0.031367272,0.0048545534,0.0011594126,0.0061459774,0.035341665],"category_scores_gemma":[0.006547287,0.0002749877,0.0003163992,0.00070569944,0.003283367,0.0021730505,0.0031900697,0.010970664,0.0023220386],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008724425,0.00004567984,0.005766851,0.000043747084,0.000021599595,0.0028355522,0.03559094,0.0002878584,0.00035819484,0.21665399,0.71872574,0.019582586],"study_design_scores_gemma":[0.000014276169,0.000022147115,0.0060505434,0.000082913786,0.000016700724,0.00024513865,0.04381933,0.00024848754,0.00057003554,0.008842759,0.94004107,0.00004656514],"about_ca_topic_score_codex":0.6375806,"about_ca_topic_score_gemma":0.9306354,"teacher_disagreement_score":0.36241943,"about_ca_system_score_codex":0.024507543,"about_ca_system_score_gemma":0.022710325,"threshold_uncertainty_score":0.72910756},"labels":[],"label_agreement":null},{"id":"W7024955675","doi":"","title":"From Statement Earrings to Pendants: A Look at Top Diamond Trends in 2024","year":2024,"lang":"en","type":"other","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Statement (logic); Diamond; Gloom; Quarter (Canadian coin); Clothing","score_opus":0.03408062360935268,"score_gpt":0.4026055730486962,"score_spread":0.36852494943934355,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7024955675","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021201225,0.074573316,0.014333431,0.3246515,0.016060269,0.00014848469,0.038253013,0.004339909,0.50643885],"genre_scores_gemma":[0.2238035,0.0909466,0.044908646,0.09270176,0.011729074,0.00044829704,0.071280695,0.010255972,0.45392552],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99316037,0.0017675277,0.00047377902,0.00076842034,0.0032099802,0.00061981],"domain_scores_gemma":[0.945052,0.027803926,0.002790788,0.002798768,0.017261202,0.0042932658],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009773445,0.0005822315,0.0005342092,0.0108039975,0.0025719358,0.0071724355,0.0018612541,0.001432036,0.10493079],"category_scores_gemma":[0.060475808,0.00036740315,0.00061783864,0.015822126,0.002245438,0.00910265,0.003665434,0.0041564787,0.03635135],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010712902,0.000040445397,0.0031789506,0.00042135944,0.0000104938845,0.000059587564,0.00085917616,0.00013490288,0.00016920401,0.044213932,0.6548161,0.2959887],"study_design_scores_gemma":[0.000010482156,0.00001751446,0.004054681,0.0007063307,0.000009556553,0.000103026585,0.0017398128,0.0004174113,0.00036443773,0.015367066,0.97718674,0.000022868053],"about_ca_topic_score_codex":0.032308184,"about_ca_topic_score_gemma":0.044948682,"teacher_disagreement_score":0.10493079,"about_ca_system_score_codex":0.00448723,"about_ca_system_score_gemma":0.009208305,"threshold_uncertainty_score":0.35102844},"labels":[],"label_agreement":null},{"id":"W7027474971","doi":"","title":"Computational analysis of discursive platforms: Effects of platform design and administrative intervention on disclosure","year":2019,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Intervention (counseling); Discourse analysis; Key (lock); Qualitative research; Data collection","score_opus":0.035577756518868645,"score_gpt":0.34162598638472147,"score_spread":0.30604822986585284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7027474971","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.90477675,0.00046583524,0.04374036,0.011531074,0.0006505975,0.0014833015,0.007872448,0.0006402157,0.028839419],"genre_scores_gemma":[0.9609958,0.0001710587,0.028138442,0.00051228976,0.000077677876,0.0015745559,0.001833565,0.0002944011,0.006402237],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98219645,0.013447899,0.00082123076,0.0012628722,0.00172535,0.0005461433],"domain_scores_gemma":[0.5006674,0.46251634,0.014385383,0.012248173,0.0070111095,0.0031715506],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0313537,0.00047549087,0.00080808904,0.0011052092,0.0021322314,0.0040087793,0.0020907023,0.00091218646,0.026523765],"category_scores_gemma":[0.29723838,0.0003917218,0.0010642948,0.0016394071,0.0014119241,0.002367198,0.0022338936,0.0032456717,0.0024777905],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.015577203,0.0051398887,0.3244844,0.0033747135,0.0012454152,0.00068053603,0.021914078,0.060013924,0.0063591814,0.06948948,0.12228573,0.36943537],"study_design_scores_gemma":[0.0018841345,0.0029437188,0.36025372,0.001395884,0.0016197086,0.000375135,0.019527283,0.441948,0.017819956,0.09087274,0.06082043,0.00053923985],"about_ca_topic_score_codex":0.0076950355,"about_ca_topic_score_gemma":0.010129188,"teacher_disagreement_score":0.0313537,"about_ca_system_score_codex":0.0025849433,"about_ca_system_score_gemma":0.0049860533,"threshold_uncertainty_score":0.16581619},"labels":[],"label_agreement":null},{"id":"W7030185557","doi":"","title":"The many faces of subjectivity in journalism: Multidisciplinary discourse analysis using linguistics and machine learning","year":2024,"lang":"en","type":"article","venue":"Digital Access to Libraries (Université catholique de Louvain (UCL), l'Université de Namur (UNamur) and the Université Saint-Louis (USL-B))","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Subjectivity; Credibility; Journalism; Discourse analysis; Sentiment analysis; Set (abstract data type); Social media; Corpus linguistics; Natural language; Computational linguistics","score_opus":0.018852639995314863,"score_gpt":0.27489559515462997,"score_spread":0.2560429551593151,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7030185557","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.39747602,0.028365029,0.524024,0.021999788,0.00049821567,0.00086202257,0.0006380759,0.0005287818,0.025608147],"genre_scores_gemma":[0.79429054,0.005123976,0.19572978,0.00078716874,0.0005451407,0.0007223563,0.00040479787,0.00021216153,0.002184103],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.9797935,0.014783493,0.00096537184,0.0018545254,0.0022349579,0.00036818648],"domain_scores_gemma":[0.9359315,0.054962948,0.00323427,0.0024309433,0.0026000957,0.00084026944],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02532839,0.00092881883,0.0013283753,0.023784237,0.0042787674,0.013210758,0.0017555117,0.0018076615,0.0016544092],"category_scores_gemma":[0.03394072,0.00073192356,0.0010820249,0.010466494,0.011880988,0.014863705,0.007819831,0.002218049,0.0003436096],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019434642,0.0003372074,0.035842538,0.0022775126,0.00033080883,0.0008501094,0.328779,0.002827674,0.0042780624,0.14098078,0.0039111967,0.4793907],"study_design_scores_gemma":[0.0000766483,0.00012726497,0.041732293,0.0027951503,0.00021683976,0.0006592334,0.22334288,0.0587416,0.0054887836,0.5894849,0.0771062,0.00022820671],"about_ca_topic_score_codex":0.0021019632,"about_ca_topic_score_gemma":0.0027965219,"teacher_disagreement_score":0.02532839,"about_ca_system_score_codex":0.003739001,"about_ca_system_score_gemma":0.0035026514,"threshold_uncertainty_score":0.13395089},"labels":[],"label_agreement":null},{"id":"W7034208475","doi":"","title":"Surco - 2017/07/07 Atomic Cowboy Bootleg","year":2017,"lang":"en","type":"other","venue":"Bulletin of Miscellaneous Information (Royal Gardens Kew)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Guitar; Quarter (Canadian coin); Sky; Roller coaster","score_opus":0.01587365400397099,"score_gpt":0.26471028921269507,"score_spread":0.24883663520872407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7034208475","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010930428,0.00023988007,0.00073615427,0.0015348347,0.0015631497,0.00009573772,0.014569998,0.002962694,0.9772045],"genre_scores_gemma":[0.0022847347,0.00011616956,0.00026536177,0.00019536082,0.000102656646,0.000033759203,0.0061842166,0.0010499465,0.98976785],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994423,0.00005610277,0.000011887988,0.00006547853,0.00029384173,0.00013044907],"domain_scores_gemma":[0.99792624,0.0001281954,0.00005119863,0.00018706333,0.0010033363,0.00070399366],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0008386065,0.000550059,0.00047478024,0.0014243759,0.0025607832,0.004381398,0.00079964264,0.0009931854,0.8433102],"category_scores_gemma":[0.002850514,0.00029435343,0.0003271514,0.0013455381,0.00049654377,0.0018724165,0.0025492215,0.0015353828,0.74388504],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030179192,0.00001759489,0.00015273801,0.00002679152,9.294479e-7,0.000017636805,0.000034229055,0.000011057911,0.00007982041,0.00085540814,0.9865893,0.012184266],"study_design_scores_gemma":[0.000004203074,0.0000071602185,0.00062687945,0.000026080123,5.688171e-7,0.0000129247155,0.00009081327,0.000030988405,0.00012306291,0.00022362778,0.9988501,0.000003505579],"about_ca_topic_score_codex":0.016243808,"about_ca_topic_score_gemma":0.07304913,"teacher_disagreement_score":0.8433102,"about_ca_system_score_codex":0.001968999,"about_ca_system_score_gemma":0.0024948225,"threshold_uncertainty_score":0.223499},"labels":[],"label_agreement":null},{"id":"W7034348456","doi":"","title":"Strike the wok an anthology of contemporary Chinese Canadian fiction","year":2003,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Narrative; China; Period (music); Interpretation (philosophy)","score_opus":0.051956849106699336,"score_gpt":0.3793510252992945,"score_spread":0.32739417619259514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7034348456","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19184908,0.036741976,0.0040328167,0.05372736,0.0128224725,0.00017915716,0.0018766192,0.00033443683,0.698436],"genre_scores_gemma":[0.74425715,0.010304546,0.0023478302,0.0027412763,0.001662971,0.00005618509,0.0005083668,0.00017704623,0.23794454],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.999509,0.00008141758,0.000011639501,0.00005199268,0.0002079033,0.0001379985],"domain_scores_gemma":[0.99926525,0.0003071836,0.000035553487,0.00002270864,0.00022822047,0.0001411542],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005499222,0.00076678477,0.00041195742,0.0047477675,0.015271135,0.004252539,0.000634467,0.00094495935,0.0074757007],"category_scores_gemma":[0.002409479,0.00013638313,0.00025796657,0.0063839788,0.005436276,0.0011051702,0.001128539,0.0020282017,0.00040252568],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020673516,0.000029525994,0.0025714417,0.00084072,0.00004359022,0.0012904663,0.22042765,0.00050034036,0.0016889172,0.3180117,0.35273755,0.10165137],"study_design_scores_gemma":[0.000005274797,0.000011913609,0.007117684,0.00018682945,0.000020494452,0.0001539644,0.03154972,0.0002539662,0.0003451475,0.004414877,0.95590854,0.00003159679],"about_ca_topic_score_codex":0.7464535,"about_ca_topic_score_gemma":0.9128125,"teacher_disagreement_score":0.25354648,"about_ca_system_score_codex":0.03347684,"about_ca_system_score_gemma":0.024452504,"threshold_uncertainty_score":0.51007926},"labels":[],"label_agreement":null},{"id":"W7035217374","doi":"","title":"Подолання пропагандистського і політичного підходів у поданні зарубіжного досвіду підготовки майбутнього вчителя на сторінках українських педагогічних часописів, у так звану пору «плюралізму та гласності»(1985–1991 рр.)","year":2015,"lang":"uk","type":"article","venue":"ENPUIR (National Pedagogical Dragomanov University)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Selection (genetic algorithm); Secondary education; Ridiculous; Period (music)","score_opus":0.37683155164825116,"score_gpt":0.42230781231631165,"score_spread":0.045476260668060486,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7035217374","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030495249,0.023121359,0.09252606,0.024081724,0.0017775992,0.0002410712,0.001135632,0.0004237073,0.82619756],"genre_scores_gemma":[0.61656904,0.022253668,0.097827725,0.0020636132,0.0012519222,0.00068244286,0.0009905932,0.0010215325,0.25733945],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9960582,0.0011443034,0.0001691954,0.00058373605,0.0017264374,0.00031804113],"domain_scores_gemma":[0.99711525,0.0009224551,0.0002583652,0.00051179837,0.0009182417,0.00027382342],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030235415,0.0004904685,0.0003620949,0.0023535162,0.0028816261,0.009496947,0.0008619283,0.0017001275,0.040350147],"category_scores_gemma":[0.00629003,0.0006351982,0.0005548698,0.0024116875,0.007297152,0.005593844,0.0031495327,0.0024206927,0.011343924],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007544673,0.000037163976,0.0013446186,0.00026935135,0.000022489794,0.00023014093,0.0050834236,0.0006142935,0.002247345,0.8717182,0.02506523,0.09329223],"study_design_scores_gemma":[0.000025388337,0.000048699167,0.0034034478,0.00033552054,0.0000302592,0.00034803277,0.0032542243,0.00046332463,0.002523887,0.24079207,0.7487212,0.000053944965],"about_ca_topic_score_codex":0.005822877,"about_ca_topic_score_gemma":0.008862475,"teacher_disagreement_score":0.040350147,"about_ca_system_score_codex":0.003328715,"about_ca_system_score_gemma":0.005204865,"threshold_uncertainty_score":0.13498467},"labels":[],"label_agreement":null},{"id":"W7036319421","doi":"","title":"Associations between walking behaviour and personal and environmental factors in older adults living in a downtown neighbourhood","year":2008,"lang":"en","type":"dissertation","venue":"Mspace (University of Manitoba)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Neighbourhood (mathematics); Walkability; Downtown; Built environment; Physical activity; Sample (material); Personal income; Association (psychology)","score_opus":0.01533351175696839,"score_gpt":0.24703393626086748,"score_spread":0.23170042450389908,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7036319421","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.999694,0.00008585734,0.00001715111,0.000012188872,0.0000016342424,0.0000018560382,0.000045210683,3.8470935e-7,0.00014174433],"genre_scores_gemma":[0.99946934,0.00014564188,0.00006501382,0.000013597322,0.000002662342,0.0000050093217,0.000110589164,5.977712e-7,0.0001875367],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99981076,0.000047036676,0.000026382266,0.000034816258,0.00005265015,0.000028366947],"domain_scores_gemma":[0.99950147,0.00011062141,0.0001612791,0.000029311477,0.00008855563,0.00010874303],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00029391822,0.00014958045,0.00021345605,0.0004544034,0.00032313043,0.0004754322,0.00016045429,0.00026145668,0.0010673322],"category_scores_gemma":[0.001532968,0.00014780492,0.00016278017,0.0005934244,0.00017632499,0.00025556795,0.0004035383,0.0003311697,0.00012811381],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030754647,0.00004893015,0.99782974,0.000010443734,0.000030187195,0.000031418138,0.00033159635,0.000013186249,0.00017704105,0.0000068942877,0.0000324119,0.0014573872],"study_design_scores_gemma":[0.0000011474211,0.000025293846,0.99947006,0.0000044606795,0.0000074707814,0.00002720015,0.00035975015,0.000030696818,0.0000143193865,0.000005403093,0.000053250948,9.3002376e-7],"about_ca_topic_score_codex":0.018541886,"about_ca_topic_score_gemma":0.052229494,"teacher_disagreement_score":0.018541886,"about_ca_system_score_codex":0.00021689823,"about_ca_system_score_gemma":0.00020380341,"threshold_uncertainty_score":0.036867917},"labels":[],"label_agreement":null},{"id":"W7038952186","doi":"","title":"La dame de Peyrassol : vigneronne en Provence","year":2008,"lang":"fr","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nova scotia; Electrocution; New england","score_opus":0.041010693492574704,"score_gpt":0.3724872562932851,"score_spread":0.3314765628007104,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7038952186","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09152992,0.0847905,0.0056183734,0.21052517,0.006140927,0.00007129679,0.0004699978,0.00013664376,0.6007172],"genre_scores_gemma":[0.5984484,0.026354123,0.0024242601,0.010606247,0.0009412637,0.00007020075,0.00015479208,0.0002617292,0.360739],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99898523,0.00040543755,0.000014325659,0.00016727697,0.00020805452,0.00021972106],"domain_scores_gemma":[0.99957246,0.00015800704,0.00004444755,0.00002192333,0.0000790496,0.00012414657],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010928181,0.00045533176,0.00028694927,0.00078821444,0.007548606,0.0034161962,0.0006016524,0.001220372,0.01773149],"category_scores_gemma":[0.0021297024,0.0002110627,0.00019398626,0.0010556339,0.007647459,0.0020854909,0.0026564796,0.0038678052,0.0012816833],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012631882,0.000033572076,0.0026622263,0.000256545,0.000021708427,0.0025601243,0.1712403,0.00028470033,0.0009141817,0.6004429,0.12116422,0.10029321],"study_design_scores_gemma":[0.0000022580762,0.000006924126,0.0015797399,0.000077737976,0.000001550169,0.00014322794,0.0114571275,0.000020798832,0.000101169026,0.0036621448,0.98294026,0.0000070789833],"about_ca_topic_score_codex":0.20265745,"about_ca_topic_score_gemma":0.4165031,"teacher_disagreement_score":0.20265745,"about_ca_system_score_codex":0.010575716,"about_ca_system_score_gemma":0.0051976955,"threshold_uncertainty_score":0.4029557},"labels":[],"label_agreement":null},{"id":"W7040864106","doi":"","title":"","year":2021,"lang":"fr","type":"other","venue":"Directory of Open access Books (OAPEN Foundation)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Poison control; Public investment; California Proposition 13","score_opus":0.19916102344391862,"score_gpt":0.5096818930694368,"score_spread":0.31052086962551817,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7040864106","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017290073,0.0044783955,0.002113191,0.012825594,0.002545806,0.00026180857,0.00421352,0.00036689025,0.9559047],"genre_scores_gemma":[0.076409,0.0027006674,0.002188945,0.0021091832,0.00015795011,0.00012655642,0.0040092007,0.00012736474,0.91217107],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980124,0.00020144717,0.000098444536,0.00035590908,0.00065726496,0.000674538],"domain_scores_gemma":[0.99775165,0.000127386,0.00010212917,0.0002678277,0.001113387,0.0006375784],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0015123952,0.00052127795,0.00034253794,0.0014644469,0.005944185,0.0062036556,0.0015761288,0.0015870731,0.13240962],"category_scores_gemma":[0.0032592304,0.00029925918,0.0004338773,0.002380582,0.0018744717,0.0015218273,0.002576326,0.0013711773,0.040267196],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024062324,0.00009948381,0.019979874,0.0005668847,0.000029141329,0.00075832236,0.008746475,0.00031989286,0.003257511,0.22015648,0.43755755,0.30828786],"study_design_scores_gemma":[0.000005740199,0.000008935483,0.005989479,0.0001223016,0.000003669886,0.00009019812,0.0016780946,0.000035931233,0.00026768388,0.0013387041,0.99044853,0.0000106873995],"about_ca_topic_score_codex":0.514038,"about_ca_topic_score_gemma":0.64108783,"teacher_disagreement_score":0.86759037,"about_ca_system_score_codex":0.0151514765,"about_ca_system_score_gemma":0.04044246,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W7066482558","doi":"","title":"Insights into the accuracy of social scientists' forecasts of societal change.","year":2023,"lang":"en","type":"article","venue":"eScholarship (California Digital Library)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; National Research University Higher School of Economics; Ministerio de Ciencia e Innovación; Agentúra na Podporu Výskumu a Vývoja; John Templeton Foundation; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; National Institutes of Health; National Science Foundation","keywords":"Aggregate (composite); Benchmarking; Sample (material); Aggregate data; Ideology; Politics; Consensus forecast","score_opus":0.05509318612649469,"score_gpt":0.32678127455511646,"score_spread":0.2716880884286218,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7066482558","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.94591,0.0018583077,0.024676722,0.008906392,0.00023406088,0.000061403305,0.0032277417,0.0003184336,0.014806901],"genre_scores_gemma":[0.9957948,0.00018437949,0.0028637329,0.00018781086,0.00009056278,0.000014864949,0.00061086554,0.000016639271,0.00023637706],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9905347,0.005341067,0.0004559384,0.0013633866,0.0019212811,0.00038361235],"domain_scores_gemma":[0.8484794,0.123614505,0.012822656,0.00854933,0.005202507,0.0013316137],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.023258483,0.00072326633,0.00067683455,0.004247738,0.0007189202,0.0038487564,0.00086804305,0.001609138,0.002323453],"category_scores_gemma":[0.13872463,0.00037875323,0.0007465457,0.0026593795,0.0014426145,0.0051722093,0.0014727482,0.0016582159,0.0006192612],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007146919,0.00029077948,0.7539971,0.00030941833,0.0013678059,0.00016563328,0.004843548,0.109516285,0.0015012047,0.01665497,0.008642528,0.101996064],"study_design_scores_gemma":[0.00009927292,0.0003092754,0.35221466,0.0001961271,0.00030608877,0.00013229555,0.0031248236,0.52652913,0.0016081554,0.10793397,0.0074063176,0.00013991984],"about_ca_topic_score_codex":0.008504545,"about_ca_topic_score_gemma":0.008791321,"teacher_disagreement_score":0.9767415,"about_ca_system_score_codex":0.0012136244,"about_ca_system_score_gemma":0.0009418152,"threshold_uncertainty_score":0.12300408},"labels":[],"label_agreement":null},{"id":"W7071768478","doi":"","title":"Uncovering Semantic Shifts in Climate Discourse among Dutch Parliamentarians: A Dynamic Bernoulli Embeddings Approach","year":2023,"lang":"en","type":"article","venue":"Research portal (Tilburg University)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Bernoulli's principle; Semantics (computer science); Set (abstract data type); Focus (optics); Feature (linguistics)","score_opus":0.05605924986015217,"score_gpt":0.39889060622809547,"score_spread":0.3428313563679433,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7071768478","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8096636,0.0013975694,0.16200565,0.0039589717,0.00032605513,0.00012956906,0.007473213,0.00044904795,0.0145963365],"genre_scores_gemma":[0.9724329,0.00019177805,0.021033444,0.00010263926,0.000081570135,0.000100329526,0.0038398101,0.000103659746,0.0021138703],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976834,0.0013015432,0.0001156834,0.0005108257,0.00022034968,0.0001680989],"domain_scores_gemma":[0.99237317,0.0060716723,0.0005078763,0.0003757349,0.0004922493,0.00017924675],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022823047,0.0004380938,0.00044522036,0.0026415875,0.0009877698,0.0023386355,0.0007412798,0.001094485,0.0035311852],"category_scores_gemma":[0.016357873,0.00039267223,0.00052177504,0.003061309,0.00087391876,0.0042821164,0.0023521069,0.0018072332,0.0010074193],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020719764,0.0013204227,0.17548467,0.0011630822,0.0005655734,0.00071442255,0.031164888,0.054258805,0.023469556,0.16732241,0.03071298,0.5117512],"study_design_scores_gemma":[0.00008417911,0.00014789541,0.083338365,0.00035159462,0.00021417499,0.00026082434,0.014557309,0.6814414,0.0051206187,0.16941966,0.04490201,0.00016198722],"about_ca_topic_score_codex":0.0101302825,"about_ca_topic_score_gemma":0.0139478315,"teacher_disagreement_score":0.0101302825,"about_ca_system_score_codex":0.0011987031,"about_ca_system_score_gemma":0.001231671,"threshold_uncertainty_score":0.020142615},"labels":[],"label_agreement":null},{"id":"W7072033201","doi":"","title":"Use of artificial intelligence (AI) in historical records transcription: Opportunities, challenges, and future directions","year":2023,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"McGill University","keywords":"Historical record; Process (computing); Event (particle physics); Interpretation (philosophy)","score_opus":0.1942857024387577,"score_gpt":0.3437034392045657,"score_spread":0.149417736765808,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7072033201","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11863263,0.07920146,0.5309339,0.16892393,0.0031731003,0.0010591622,0.0028843642,0.002765312,0.092426136],"genre_scores_gemma":[0.38031563,0.0498743,0.5468849,0.0058716843,0.0024991347,0.0005154883,0.0020377967,0.0005532994,0.011447794],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98008084,0.014017529,0.0011538567,0.0016124931,0.0027104325,0.00042486392],"domain_scores_gemma":[0.84649515,0.12498216,0.004809991,0.00725923,0.014758491,0.0016949301],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037147008,0.00051266165,0.00082008797,0.0031349564,0.001486437,0.012895502,0.0021176664,0.001191676,0.005680464],"category_scores_gemma":[0.08261228,0.00039074168,0.00076032203,0.0051817945,0.0027124186,0.011899745,0.0025352933,0.002488623,0.0022269916],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015415224,0.000156512,0.014838682,0.0009857604,0.000097800366,0.00008583219,0.0057622544,0.0010878259,0.0033022552,0.0126981335,0.012961129,0.9478696],"study_design_scores_gemma":[0.00018435698,0.0007392411,0.06530851,0.008444854,0.000610491,0.0015190506,0.07924826,0.11063658,0.02310497,0.2608961,0.44871315,0.00059449667],"about_ca_topic_score_codex":0.010710413,"about_ca_topic_score_gemma":0.01473694,"teacher_disagreement_score":0.037147008,"about_ca_system_score_codex":0.0018543502,"about_ca_system_score_gemma":0.0050341785,"threshold_uncertainty_score":0.19645447},"labels":[],"label_agreement":null},{"id":"W7081985209","doi":"10.1016/j.cjco.2025.09.001","title":"Heart Failure Readmission Risk Factors: A Modified Delphi Panel Study","year":2025,"lang":"en","type":"article","venue":"CJC Open","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Alberta Health Services; Libin Cardiovascular Institute of Alberta; South Health Campus; University of Calgary","funders":"Libin Cardiovascular Institute, University of Calgary","keywords":"Delphi method; Heart failure; Risk management; Delphi; Risk assessment; Stakeholder","score_opus":0.1128740806726955,"score_gpt":0.4403821115095965,"score_spread":0.327508030836901,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7081985209","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.940611,0.0014480086,0.01767143,0.0048871646,0.00020574199,0.027887287,0.00074613054,0.00003562123,0.0065076775],"genre_scores_gemma":[0.9269256,0.0017985402,0.027047597,0.0022226232,0.00006338745,0.0406715,0.00052967353,0.000019291601,0.00072178594],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.86083454,0.11689139,0.007668111,0.0027328278,0.00686983,0.005003268],"domain_scores_gemma":[0.89871025,0.06879823,0.0044492222,0.0026277602,0.022709832,0.0027046853],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16280288,0.0010673678,0.0012384139,0.0040309406,0.0039768512,0.0025685593,0.001812494,0.002532849,0.0017419221],"category_scores_gemma":[0.119041085,0.0011764494,0.0024381008,0.0028502918,0.0028407546,0.0031982618,0.008449828,0.0026938196,0.00047463182],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015465772,0.0015787006,0.08447055,0.009288707,0.0007602599,0.0019916368,0.71273494,0.003128934,0.003374545,0.0041888515,0.010699591,0.16623667],"study_design_scores_gemma":[0.0011265795,0.0059346952,0.1323758,0.010524928,0.00050033804,0.0013935514,0.78500503,0.010732268,0.0031267472,0.008278904,0.040372055,0.0006290742],"about_ca_topic_score_codex":0.005630967,"about_ca_topic_score_gemma":0.0077255596,"teacher_disagreement_score":0.16280288,"about_ca_system_score_codex":0.0071588564,"about_ca_system_score_gemma":0.01689172,"threshold_uncertainty_score":0.8609942},"labels":[],"label_agreement":null},{"id":"W7082000016","doi":"10.11159/icceia25.137","title":"Effect of Incinerator Fly Ash on the Properties of Slag-Based Geopolymer Mortar","year":2025,"lang":"en","type":"article","venue":"Proceedings of the World Congress on New Technologies","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"United Arab Emirates University","keywords":"Fly ash; Geopolymer; Mortar; Incineration; Incinerator bottom ash","score_opus":0.01870654803955168,"score_gpt":0.3090862421756104,"score_spread":0.29037969413605874,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7082000016","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99850947,0.0005151877,0.00038974432,0.0000106587,0.0000063815214,0.00000836745,0.000093713636,0.0000150879205,0.00045120934],"genre_scores_gemma":[0.9988036,0.0002628271,0.00036341915,0.000010838563,0.0000022582192,0.000004242075,0.00006090361,0.000008051518,0.00048376562],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9997322,0.000040414863,0.00002557214,0.00003984616,0.00011267668,0.00004931073],"domain_scores_gemma":[0.99970144,0.00007948172,0.000093354865,0.0000190661,0.00007708813,0.000029602448],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00027218132,0.00030151277,0.00024261884,0.00034371298,0.00016383843,0.00032616575,0.00015879452,0.00023856174,0.0008780085],"category_scores_gemma":[0.0003812036,0.000111886606,0.00024132367,0.00023426622,0.00017456831,0.00023303162,0.00013693458,0.00030637244,0.0002020146],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016277278,0.00002996053,0.0011211219,0.00008038081,0.00001337811,0.000044059165,0.000036080477,0.0003195022,0.99510515,0.00001811476,0.000013314445,0.0030561765],"study_design_scores_gemma":[0.0000019701238,0.00039012046,0.008074954,0.0000066932384,0.000018978586,0.00003362189,0.000045382738,0.000484994,0.9904981,0.000010547985,0.00042931509,0.000005215882],"about_ca_topic_score_codex":0.0011564603,"about_ca_topic_score_gemma":0.0034410737,"teacher_disagreement_score":0.0011564603,"about_ca_system_score_codex":0.00019863786,"about_ca_system_score_gemma":0.00018568303,"threshold_uncertainty_score":0.0029371977},"labels":[],"label_agreement":null},{"id":"W7083167857","doi":"10.1016/j.jprocont.2025.103550","title":"Real-time freeze point prediction using multirate measurements in the blending process","year":2025,"lang":"en","type":"article","venue":"Journal of Process Control","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Process (computing); Control theory (sociology); Point (geometry); Multi point; Process variable","score_opus":0.05387920022535448,"score_gpt":0.4072366987063104,"score_spread":0.35335749848095593,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083167857","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7645974,0.0003328968,0.23290105,0.00012087704,0.00007828815,0.000038633887,0.00017384428,0.00073537574,0.0010216192],"genre_scores_gemma":[0.98965245,0.00006541102,0.0099639315,0.000006518798,0.0000064389515,0.0000084207195,0.000050462586,0.000024906858,0.00022143294],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99983776,0.000017479942,0.000010529711,0.000052161777,0.000063877465,0.0000181593],"domain_scores_gemma":[0.99938035,0.00029598712,0.00010445185,0.000053098753,0.00012877151,0.000037280057],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00056711055,0.0006145188,0.0008822704,0.0005349488,0.00031722803,0.0008676304,0.00051598327,0.00077995856,0.0005747067],"category_scores_gemma":[0.0016682,0.0002881495,0.00037322412,0.0006125762,0.00043438427,0.0010212483,0.00043416157,0.00067444885,0.00015847883],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020289463,0.00038248624,0.024522979,0.00033913818,0.000077528326,0.00047634082,0.00031555342,0.70744693,0.13637471,0.0017061406,0.00054159976,0.12578769],"study_design_scores_gemma":[0.000006156137,0.000024422574,0.0011360093,0.0000022678546,0.0000046701803,0.000009762208,0.00000914342,0.990624,0.007974581,0.00015032894,0.000051337483,0.000007452145],"about_ca_topic_score_codex":0.0036269666,"about_ca_topic_score_gemma":0.0028719164,"teacher_disagreement_score":0.0036269666,"about_ca_system_score_codex":0.0003239849,"about_ca_system_score_gemma":0.00039791956,"threshold_uncertainty_score":0.007211745},"labels":[],"label_agreement":null},{"id":"W7083319572","doi":"10.15468/dl.f4zzm4","title":"Occurrence Download","year":2025,"lang":"en","type":"dataset","venue":"Global Biodiversity Information Facility","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Lichen; Herbarium; Parmeliaceae; Botanical garden","score_opus":0.02372387313726041,"score_gpt":0.3027258692587398,"score_spread":0.27900199612147936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083319572","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00004161524,0.000039575516,0.00007179162,0.000046078458,0.000026180405,0.000010139445,0.9973568,0.0009444336,0.0014634595],"genre_scores_gemma":[0.00020979646,0.00005898801,0.00046712268,0.000086148015,0.00000872779,0.000060832404,0.9975883,0.0002894175,0.0012306737],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99873453,0.00015863507,0.00016101293,0.00050116965,0.000223802,0.00022083758],"domain_scores_gemma":[0.99728894,0.0007292185,0.00019625394,0.0006948265,0.00069046154,0.00040026486],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.00094949885,0.0026191715,0.0022204027,0.005950922,0.001163372,0.0038663207,0.0026282994,0.0021939268,0.37938246],"category_scores_gemma":[0.006512662,0.00094658986,0.0019129007,0.00971126,0.00038851495,0.0033979055,0.0036407267,0.0019920527,0.43571916],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005811183,0.000014719604,0.00030921513,0.0006232495,0.000015992355,0.00001473653,0.000022164893,0.00012358365,0.00009377374,0.00040901735,0.9950324,0.0032829584],"study_design_scores_gemma":[0.00009750505,0.000016336975,0.0015086576,0.00020950132,0.000017695185,0.000034796813,0.0000755195,0.00028244036,0.00013915912,0.0012337966,0.99636155,0.000022933866],"about_ca_topic_score_codex":0.020537248,"about_ca_topic_score_gemma":0.034460656,"teacher_disagreement_score":0.6206175,"about_ca_system_score_codex":0.0015235709,"about_ca_system_score_gemma":0.0024677645,"threshold_uncertainty_score":0.8852356},"labels":[],"label_agreement":null},{"id":"W7083335449","doi":"10.5283/epub.76189","title":"Development of consensus-driven SPIRIT and CONSORT extensions for early phase dose-finding trials: the DEFINE study","year":2023,"lang":"en","type":"article","venue":"University of Regensburg Publication Server (University of Regensburg)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Genentech; National Institutes of Health; Sierra Oncology; Eisai; Department of Health and Social Care; National Institute for Health and Care Research; National Center for Advancing Translational Sciences; Seagen; Astellas Pharma; NuCana; Sanofi; Halozyme; PTC Therapeutics; Medical Research Council; Celgene; Plexxikon; BeiGene; GlaxoSmithKline; Pfizer; UK Research and Innovation; Eli Lilly and Company; Bristol-Myers Squibb","keywords":"Delphi method; Delphi; Inclusion (mineral); Thematic analysis; Protocol (science); Intervention (counseling); Consolidated Standards of Reporting Trials; Clinical trial","score_opus":0.20284568678975878,"score_gpt":0.3872655648476107,"score_spread":0.18441987805785193,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083335449","genre_codex":"protocol","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064829476,0.0039925883,0.34880272,0.009546192,0.0059376713,0.60877013,0.006960798,0.0021524527,0.0073544974],"genre_scores_gemma":[0.006128776,0.00060120283,0.36592716,0.0012813483,0.00016415872,0.62377554,0.0014235275,0.00021956224,0.00047878068],"study_design_codex":"design_other","study_design_gemma":"qualitative","domain_scores_codex":[0.20619433,0.6406997,0.11480904,0.009565816,0.02577645,0.0029547054],"domain_scores_gemma":[0.155935,0.5452829,0.06043656,0.08972322,0.14309667,0.005525608],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7260943,0.004423873,0.0075320737,0.014146487,0.0046960516,0.013983146,0.009615318,0.008024111,0.015483377],"category_scores_gemma":[0.79265696,0.0066894437,0.015708065,0.012089589,0.0073742294,0.012172692,0.016800527,0.015564405,0.007796407],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0068940762,0.00093874615,0.009516821,0.19677223,0.00578827,0.0007823079,0.0323743,0.009569013,0.0024913626,0.09805101,0.17172986,0.465092],"study_design_scores_gemma":[0.020715443,0.0037157747,0.012357818,0.18678744,0.0061000073,0.001066782,0.011121048,0.024697404,0.00793116,0.17630853,0.5478039,0.0013948489],"about_ca_topic_score_codex":0.00095612404,"about_ca_topic_score_gemma":0.0021610393,"teacher_disagreement_score":0.2739057,"about_ca_system_score_codex":0.011288276,"about_ca_system_score_gemma":0.05481616,"threshold_uncertainty_score":0.33777452},"labels":[],"label_agreement":null},{"id":"W7083350538","doi":"","title":"Redesain stadion sepak bola dan wisma atlet Moh. Sarengat di Kabupaten Batang dengan pendekatan arsitektur biophilic","year":2023,"lang":"id","type":"other","venue":"Walisongo Repository (Walisongo State Islamic University)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Queer; Empire; Quarter (Canadian coin); Key (lock)","score_opus":0.01841330698550512,"score_gpt":0.25543896930439114,"score_spread":0.23702566231888603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083350538","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7289422,0.012516255,0.08771008,0.0027238252,0.0017717609,0.0006996659,0.0036177717,0.0026906375,0.15932783],"genre_scores_gemma":[0.68356997,0.006331853,0.06524853,0.0010618111,0.00009842232,0.0003168542,0.0038833828,0.0007714313,0.2387178],"study_design_codex":"bench_or_experimental","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994344,0.000056831464,0.000045165896,0.00012812359,0.00023378913,0.000101644495],"domain_scores_gemma":[0.99930704,0.000097040494,0.00011792355,0.00010368004,0.00028476046,0.000089635396],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00062423554,0.0010467292,0.0005672573,0.0009022682,0.0010207829,0.0018531211,0.0005450277,0.0008098381,0.011824944],"category_scores_gemma":[0.00069117424,0.0005033792,0.0008942518,0.0007942943,0.00068050635,0.0012997505,0.0012224521,0.0017680344,0.0076817973],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004597861,0.00017658554,0.0053096754,0.00072575454,0.00003704107,0.0011911734,0.0010636245,0.00071477087,0.8820816,0.0038698951,0.0020005938,0.10236944],"study_design_scores_gemma":[0.000023132456,0.0008246054,0.01931467,0.00022937176,0.00014167238,0.0022498711,0.0015208863,0.0012731238,0.682146,0.0015502961,0.29063722,0.000089175956],"about_ca_topic_score_codex":0.0033526185,"about_ca_topic_score_gemma":0.006409415,"teacher_disagreement_score":0.011824944,"about_ca_system_score_codex":0.0009633986,"about_ca_system_score_gemma":0.0016375117,"threshold_uncertainty_score":0.03955835},"labels":[],"label_agreement":null},{"id":"W7083443447","doi":"10.1063/5.0296098","title":"The Lambert W function and polylogarithm functions in complex modelling for green quantum material innovations","year":2025,"lang":"en","type":"article","venue":"AIP conference proceedings","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Polylogarithm; Function (biology); Quantum; Lambert W function; Complex system","score_opus":0.07715009554774703,"score_gpt":0.3450830181177509,"score_spread":0.26793292257000384,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083443447","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.042958926,0.0011622788,0.9314709,0.0017697115,0.000271886,0.00006931615,0.00006827626,0.00024776193,0.021980943],"genre_scores_gemma":[0.7488417,0.0017232647,0.20538399,0.0006521059,0.00043376486,0.00042103522,0.00013965074,0.00086246594,0.041542],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99904937,0.00062518666,0.000034861045,0.000072872965,0.00014067892,0.000077056226],"domain_scores_gemma":[0.9970483,0.0019853022,0.00017633999,0.0004054236,0.00021560385,0.0001689282],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036827247,0.0009230153,0.0010532526,0.0021748058,0.0010542234,0.003132198,0.0019649803,0.002787729,0.005656678],"category_scores_gemma":[0.009977237,0.0005380397,0.0010100141,0.0013368484,0.0038736148,0.0056759305,0.0019863397,0.002669774,0.0010525971],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006729622,0.000013972521,0.000043224358,0.000020764704,0.000003885376,0.000018713192,0.000043892105,0.013744359,0.00030734506,0.98212516,0.0004064999,0.0032654016],"study_design_scores_gemma":[0.0000042655715,0.000007820174,0.00005400837,0.000013453031,0.0000036786785,0.000015978612,0.000028186972,0.29119068,0.00021433922,0.7074396,0.0010156435,0.000012341688],"about_ca_topic_score_codex":0.0013205286,"about_ca_topic_score_gemma":0.00096039183,"teacher_disagreement_score":0.005656678,"about_ca_system_score_codex":0.0016178817,"about_ca_system_score_gemma":0.001091739,"threshold_uncertainty_score":0.019476295},"labels":[],"label_agreement":null},{"id":"W7083633553","doi":"10.4000/14ro3","title":"Modernisation de l'éducation dans l'Ukraine d'après-guerre","year":2025,"lang":"fr","type":"article","venue":"Éducation et socialisation","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"ESPACE; History of sociology; Publics; Context (archaeology)","score_opus":0.18726949365042872,"score_gpt":0.4678880393538847,"score_spread":0.28061854570345596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083633553","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.92956823,0.0076894937,0.0048322473,0.0038546906,0.00010253528,0.000076939796,0.0002901518,0.000037369584,0.053548265],"genre_scores_gemma":[0.98519313,0.0023030466,0.0018060132,0.00015872261,0.000007026967,0.00003695876,0.000083335995,0.000014317851,0.010397479],"study_design_codex":"qualitative","study_design_gemma":"not_applicable","domain_scores_codex":[0.9981053,0.0009746926,0.00009721448,0.00022424471,0.00025531076,0.00034320581],"domain_scores_gemma":[0.9985228,0.00063239346,0.0002808905,0.00012098475,0.0003049962,0.00013790852],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032564215,0.0002703335,0.0005767401,0.0019902939,0.0035185583,0.004259756,0.0005699837,0.000534999,0.003548376],"category_scores_gemma":[0.0029412936,0.00020631366,0.0003170375,0.003007311,0.003944603,0.0021114321,0.004355946,0.0011852364,0.00024830183],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020273487,0.00009595221,0.074461594,0.0014018908,0.00008290875,0.00154543,0.47875082,0.0028518809,0.0017629414,0.21720569,0.0019620263,0.21967609],"study_design_scores_gemma":[0.000015150946,0.0001624475,0.25040647,0.0024076193,0.00008280316,0.0005519529,0.47337347,0.0011138957,0.0027399953,0.013392007,0.2556913,0.00006278623],"about_ca_topic_score_codex":0.14233959,"about_ca_topic_score_gemma":0.20783205,"teacher_disagreement_score":0.14233959,"about_ca_system_score_codex":0.017610312,"about_ca_system_score_gemma":0.017423518,"threshold_uncertainty_score":0.28302217},"labels":[],"label_agreement":null},{"id":"W7083730041","doi":"10.15468/dl.bnqgy3","title":"Occurrence Download","year":2025,"lang":"en","type":"dataset","venue":"Global Biodiversity Information Facility","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Download; Matching (statistics); Range (aeronautics); Set (abstract data type); Data set","score_opus":0.02372387313726041,"score_gpt":0.3027258692587398,"score_spread":0.27900199612147936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083730041","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000055145814,0.000027738128,0.000043315333,0.00003565864,0.000010803911,0.000006331589,0.9988667,0.00035877223,0.0005954771],"genre_scores_gemma":[0.00017724418,0.000029807246,0.00018278125,0.000042943397,0.0000034126476,0.000045018583,0.9990146,0.00011606356,0.00038811276],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989126,0.00016358719,0.00014637077,0.00035869598,0.00024890792,0.00016995151],"domain_scores_gemma":[0.9975412,0.00066350086,0.00024149739,0.00064341445,0.00060888357,0.00030152418],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010386806,0.0019185133,0.0014485974,0.0051509365,0.00094545144,0.0023590985,0.0028022365,0.0019668813,0.12892576],"category_scores_gemma":[0.006141636,0.0007936678,0.0011629454,0.009199998,0.00047029738,0.0019244308,0.00244219,0.0018482818,0.19291592],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003154323,0.000012550537,0.00038679858,0.0005047824,0.00001577552,0.000015093154,0.000021624564,0.00012301879,0.00011195691,0.0003862611,0.9969971,0.0013935044],"study_design_scores_gemma":[0.00009422107,0.000009977704,0.002050317,0.00019016741,0.000016435259,0.00004365474,0.00007432511,0.00020244258,0.00022672472,0.00092956156,0.9961444,0.000017749479],"about_ca_topic_score_codex":0.017965982,"about_ca_topic_score_gemma":0.031766087,"teacher_disagreement_score":0.12892576,"about_ca_system_score_codex":0.0015679096,"about_ca_system_score_gemma":0.0023257977,"threshold_uncertainty_score":0.43129963},"labels":[],"label_agreement":null},{"id":"W7083852006","doi":"","title":"New trade deal getting a boost from Trump, business groups","year":2019,"lang":"en","type":"other","venue":"Internet Archive (Internet Archive)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Victory; Odds; Politics; White (mutation); Plan (archaeology); New Deal; Business as usual","score_opus":0.022065277042738463,"score_gpt":0.2957110849238931,"score_spread":0.2736458078811546,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7083852006","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025960363,0.00413247,0.0009067695,0.18141624,0.03294823,0.00009051461,0.0036838045,0.0012651684,0.77296066],"genre_scores_gemma":[0.0031998649,0.0010225832,0.00043766506,0.014232972,0.002419861,0.000042696018,0.001189241,0.00040920472,0.97704595],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99821585,0.0001719513,0.00004127689,0.00021429297,0.0010921883,0.00026447698],"domain_scores_gemma":[0.9960918,0.00040615446,0.00011293678,0.00023121423,0.0014160894,0.0017417774],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002354143,0.00051920017,0.00041386476,0.0019384614,0.0045911735,0.01178987,0.0006849164,0.0036783707,0.26852158],"category_scores_gemma":[0.007979799,0.0003611465,0.0005023221,0.0024363457,0.001116523,0.0052943034,0.0026936478,0.004922104,0.12030108],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006155391,0.000007891192,0.00008284481,0.0000080701475,6.0503424e-7,0.000021902799,0.000018134971,0.0000033690824,0.000026042384,0.0020917743,0.98914087,0.0085923085],"study_design_scores_gemma":[0.0000029754049,0.000004827436,0.00051448325,0.000021133446,7.547614e-7,0.000021170565,0.000063799656,0.000023612922,0.00004581983,0.0005339601,0.99876356,0.000003888762],"about_ca_topic_score_codex":0.015660973,"about_ca_topic_score_gemma":0.05557035,"teacher_disagreement_score":0.26852158,"about_ca_system_score_codex":0.0030131596,"about_ca_system_score_gemma":0.00591247,"threshold_uncertainty_score":0.89829415},"labels":[],"label_agreement":null},{"id":"W7084045777","doi":"10.64628/aap.dxxmqpdkf","title":"La guerre en Ukraine est-elle en voie d’être résolue ?","year":2025,"lang":"fr","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Government (linguistics); Context (archaeology); Product (mathematics); Agency (philosophy)","score_opus":0.019952915002177267,"score_gpt":0.37687045889506676,"score_spread":0.3569175438928895,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7084045777","genre_codex":"empirical","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.60162103,0.06469355,0.028775778,0.1303934,0.0073336517,0.00007348739,0.0032002148,0.00044914935,0.16345984],"genre_scores_gemma":[0.9488256,0.009063724,0.0115620205,0.0039432393,0.00043129805,0.000034594945,0.0009682893,0.0001609736,0.02501027],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986028,0.0005774133,0.000085215666,0.0002463052,0.00020980844,0.00027844528],"domain_scores_gemma":[0.9983986,0.0006128438,0.00021865334,0.0002133708,0.00043161816,0.00012502482],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024160612,0.000413512,0.00076636503,0.0015991993,0.00422018,0.004701006,0.00064075255,0.0011860913,0.0055137333],"category_scores_gemma":[0.0052380934,0.00014796737,0.00032860402,0.0018513819,0.0030016406,0.0040871515,0.0024649724,0.0016373487,0.0012665645],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029191122,0.00007757345,0.050272897,0.0011730564,0.00027101432,0.0028622062,0.05467147,0.0015840497,0.0026410562,0.46456695,0.050750807,0.37083712],"study_design_scores_gemma":[0.000019728948,0.00003998434,0.04278683,0.0016572474,0.00008937523,0.0013457421,0.12296979,0.0015674536,0.0025515703,0.08094632,0.7459389,0.00008706614],"about_ca_topic_score_codex":0.06717296,"about_ca_topic_score_gemma":0.08518585,"teacher_disagreement_score":0.06717296,"about_ca_system_score_codex":0.003650046,"about_ca_system_score_gemma":0.0073475926,"threshold_uncertainty_score":0.13356394},"labels":[],"label_agreement":null},{"id":"W7084098684","doi":"10.6084/m9.figshare.29993005","title":"Additional file 2 of Structural brain differences in school-aged children who are HIV-exposed uninfected","year":2025,"lang":"en","type":"article","venue":"Figshare","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Women's College Hospital; Toronto General Hospital; SickKids Foundation; University of Toronto; Children's Hospital of Eastern Ontario; University of Ottawa; Hospital for Sick Children","funders":"","keywords":"Table (database); Central nervous system; Feature (linguistics); Expressivity","score_opus":0.027653155769234713,"score_gpt":0.3045980955494077,"score_spread":0.276944939780173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7084098684","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003703782,0.00001554298,0.00020099491,0.00007980794,0.000018040477,0.00010911876,0.9983286,0.00012868755,0.0007488799],"genre_scores_gemma":[0.018214902,0.00018219487,0.004549738,0.0006682371,0.00016095808,0.00700185,0.95591074,0.0007264739,0.012584905],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9994524,0.00009166846,0.00010624877,0.00015602658,0.00010512456,0.00008848215],"domain_scores_gemma":[0.98327905,0.012191744,0.0011340856,0.001019065,0.001991244,0.00038481856],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0011849586,0.0014013101,0.0012240666,0.0020610334,0.0012268686,0.0015854676,0.0022648005,0.0015062877,0.8745588],"category_scores_gemma":[0.032247066,0.00062474085,0.00084163324,0.0031284704,0.00026245016,0.001741753,0.001123519,0.000870905,0.11159053],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000446712,0.00011702298,0.0043452866,0.002072101,0.0000672109,0.000120443045,0.00011190567,0.00028799605,0.00008078987,0.0006860642,0.9824897,0.009174707],"study_design_scores_gemma":[0.01632796,0.00075104245,0.13806373,0.0092781205,0.00080001896,0.0027810114,0.0018403989,0.004243238,0.0016015837,0.034753446,0.7891238,0.00043573938],"about_ca_topic_score_codex":0.012803168,"about_ca_topic_score_gemma":0.01981592,"teacher_disagreement_score":0.8745588,"about_ca_system_score_codex":0.00085934554,"about_ca_system_score_gemma":0.0015837083,"threshold_uncertainty_score":0.17892659},"labels":[],"label_agreement":null},{"id":"W7084384560","doi":"10.5281/zenodo.17252286","title":"Software Artifact for \"On Computing Top-k Simple Shortest Paths from a Single Source. M. D'Emidio, G. Di Stefano\". SIAM 28th Symposium on Algorithm Engineering and Experiments (ALENEX 2026), Vancouver, Canada.","year":2025,"lang":"en","type":"other","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Artifact (error); Simple (philosophy); Software; Key (lock); Algorithm design","score_opus":0.023833160666130226,"score_gpt":0.27014122948836333,"score_spread":0.2463080688222331,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7084384560","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014438907,0.0010196146,0.27668443,0.0011214756,0.0011931945,0.0003833983,0.20017017,0.47578225,0.042201567],"genre_scores_gemma":[0.01813369,0.0013669976,0.21969077,0.00090514135,0.00026775838,0.0014286595,0.54704845,0.13316327,0.07799531],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9984932,0.00019787723,0.00015486406,0.00029357418,0.0007154944,0.00014494498],"domain_scores_gemma":[0.99549544,0.0020550713,0.00011190754,0.0009873715,0.0011899036,0.00016023671],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014685917,0.0028519998,0.0015033259,0.002276958,0.00076026586,0.002369111,0.0043015196,0.0017809133,0.2663442],"category_scores_gemma":[0.0125701325,0.0017852538,0.0018353027,0.0033924067,0.00065507327,0.0032962942,0.003184172,0.0021536702,0.18509361],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014121822,0.000050414503,0.00020934708,0.0005086618,0.000040598687,0.000032474767,0.000037883878,0.0026089903,0.0006294801,0.0049220948,0.94317406,0.047644738],"study_design_scores_gemma":[0.0006049769,0.00007834133,0.0011109845,0.00028902447,0.000053855783,0.000210472,0.00003486395,0.037779666,0.0040644067,0.029909918,0.9257896,0.00007393943],"about_ca_topic_score_codex":0.014102252,"about_ca_topic_score_gemma":0.021097975,"teacher_disagreement_score":0.2663442,"about_ca_system_score_codex":0.0010898275,"about_ca_system_score_gemma":0.0028121222,"threshold_uncertainty_score":0.89101005},"labels":[],"label_agreement":null},{"id":"W7084389070","doi":"10.1007/978-3-031-95288-3_7","title":"Effect of Transverse Reinforcement on Bond Strength of Ribbed GFRP Bars in Concrete","year":2025,"lang":"en","type":"book-chapter","venue":"Lecture notes in civil engineering","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Reinforcement; Transverse plane; Bar (unit); Bond strength; Fibre-reinforced plastic; Stiffness","score_opus":0.008741122309031181,"score_gpt":0.2781324442943229,"score_spread":0.2693913219852917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7084389070","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9954333,0.00061026943,0.0012804427,0.000036130503,0.000027382528,0.0000050709523,0.00007261439,0.00009105444,0.0024438088],"genre_scores_gemma":[0.9987534,0.0001314307,0.0003474486,0.000007015151,0.0000036601782,0.000001628635,0.000028865546,0.0000122087895,0.0007142395],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99978465,0.000033239005,0.000008638087,0.000042224186,0.0000780668,0.00005321581],"domain_scores_gemma":[0.99909806,0.00039793306,0.00016306505,0.00006459543,0.00016361961,0.000112702866],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003093477,0.00036539504,0.00034209708,0.00034296667,0.00028687075,0.0003480009,0.0004737098,0.00056210096,0.004660586],"category_scores_gemma":[0.0011124918,0.00033120599,0.00030847007,0.00023383085,0.00044810455,0.00030287204,0.00037822247,0.00051235873,0.0006031875],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019565644,0.00020489594,0.0019187739,0.00016106089,0.00004828413,0.00028996877,0.0000781045,0.06095172,0.9196819,0.000445043,0.00028033185,0.013983434],"study_design_scores_gemma":[0.000039679282,0.0023828298,0.015643343,0.000039109327,0.000142144,0.00014259953,0.00013617457,0.0769566,0.9032648,0.00025212992,0.0009679873,0.000032517153],"about_ca_topic_score_codex":0.001461288,"about_ca_topic_score_gemma":0.0025170338,"teacher_disagreement_score":0.004660586,"about_ca_system_score_codex":0.0003326084,"about_ca_system_score_gemma":0.0002772797,"threshold_uncertainty_score":0.015591204},"labels":[],"label_agreement":null},{"id":"W7087778017","doi":"10.1145/3769733.3769737","title":"Report on the 1st Workshop on Information Retrieval for Climate Impact (MANILA24) at SIGIR 2024","year":2025,"lang":"en","type":"article","venue":"ACM SIGIR Forum","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ouranos","funders":"","keywords":"Climate change; Set (abstract data type); Core (optical fiber); Cognitive models of information retrieval; Relevance (law); Human–computer information retrieval","score_opus":0.03628779379416243,"score_gpt":0.3954195328043205,"score_spread":0.3591317390101581,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7087778017","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021004668,0.10660436,0.12591726,0.23499689,0.2739554,0.0060915384,0.054898128,0.013465688,0.16306606],"genre_scores_gemma":[0.043026403,0.024518438,0.08515691,0.04314642,0.0429181,0.0061963443,0.08729173,0.008908226,0.65883744],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9821891,0.007021675,0.0005600874,0.0018058992,0.006643599,0.0017795688],"domain_scores_gemma":[0.9587536,0.011042659,0.0009674501,0.0028255149,0.017010411,0.009400409],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03030254,0.003158177,0.0024489893,0.0048027094,0.0038255302,0.011179486,0.0039401427,0.0052505317,0.09933606],"category_scores_gemma":[0.034702033,0.00096384896,0.0026659819,0.0031660527,0.0014743493,0.011578739,0.010599638,0.007371608,0.073209554],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018319667,0.00012599463,0.00019879002,0.00023195006,0.00003815378,0.000052330583,0.00018292747,0.00019025909,0.0010252413,0.000702498,0.965029,0.03203966],"study_design_scores_gemma":[0.000090934605,0.00018882508,0.0013604945,0.00028035566,0.000058469348,0.00008838667,0.00051882555,0.000885273,0.001970923,0.0027642644,0.99171233,0.000080926984],"about_ca_topic_score_codex":0.014744856,"about_ca_topic_score_gemma":0.019345809,"teacher_disagreement_score":0.09933606,"about_ca_system_score_codex":0.0035437897,"about_ca_system_score_gemma":0.008231819,"threshold_uncertainty_score":0.33231223},"labels":[],"label_agreement":null},{"id":"W7092365288","doi":"10.5281/zenodo.17387259","title":"GHUC Ω⁷.1 — Cognitive Mimicry in Artificial Intelligence: A Theoretical and Methodological Framework","year":2025,"lang":"","type":"report","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Cognition; Mimicry; Empirical research; Protocol (science); Similarity (geometry); Cognitive architecture; Traceability; Categorization","score_opus":0.18400249017203835,"score_gpt":0.4302113427440025,"score_spread":0.24620885257196418,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7092365288","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0156307,0.009930655,0.70439017,0.06300734,0.0016749984,0.008185482,0.0022066492,0.0010217112,0.19395235],"genre_scores_gemma":[0.30235475,0.0049135964,0.64314985,0.0031908804,0.0006320866,0.026732862,0.0012687907,0.00035221572,0.017404914],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9494663,0.037768416,0.0028475048,0.0037388431,0.005414457,0.00076445524],"domain_scores_gemma":[0.929729,0.04457337,0.0048546633,0.010480822,0.009046777,0.001315391],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07662982,0.0010114483,0.0010294641,0.0073107746,0.0036510832,0.008709536,0.0038751848,0.0046532964,0.011656752],"category_scores_gemma":[0.09854827,0.0009463505,0.0016205405,0.006437282,0.024918752,0.01026724,0.0064466665,0.0053475457,0.002663897],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003194004,0.000023613855,0.00028593442,0.00023856769,0.000009798042,0.000014763904,0.0009590986,0.00071892136,0.00012054481,0.9751486,0.004478662,0.017969612],"study_design_scores_gemma":[0.00007308029,0.00012861204,0.0008470258,0.0014812739,0.00003806521,0.000113038805,0.0008494445,0.0039922143,0.0010796031,0.909206,0.08212962,0.00006199535],"about_ca_topic_score_codex":0.004521599,"about_ca_topic_score_gemma":0.0021796622,"teacher_disagreement_score":0.07662982,"about_ca_system_score_codex":0.012121779,"about_ca_system_score_gemma":0.012405129,"threshold_uncertainty_score":0.40526205},"labels":[],"label_agreement":null},{"id":"W7093940323","doi":"","title":"Sea ice condition around north-west coast of Greenland to Canada archipelago in 2007-2010  - Report on the scientific survey under the AVANGNAQ 2006-2015 project -","year":2016,"lang":"en","type":"other","venue":"Institutional Repository National Institute of Polar Research (National Institute of Polar Research (Japan))","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Archipelago; Sea ice; Iceberg; Arctic; Antarctic sea ice; Arctic ice pack","score_opus":0.14292486818728348,"score_gpt":0.43907257735096233,"score_spread":0.29614770916367883,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7093940323","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.29296213,0.0011383732,0.0001803085,0.00033360114,0.00006858355,0.00007933752,0.6932612,0.000096177006,0.011880326],"genre_scores_gemma":[0.46921718,0.0025466683,0.0012091887,0.00021003983,0.000026364638,0.00014330276,0.49328128,0.00009671433,0.03326929],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99957985,0.000021856149,0.000047444562,0.000059609236,0.00018124265,0.00011005437],"domain_scores_gemma":[0.9981608,0.0000564494,0.00019870265,0.00005470679,0.0012807979,0.00024850626],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005241565,0.0004914775,0.00035063177,0.003742452,0.0008345819,0.0008722537,0.0009466657,0.00025196729,0.0025211652],"category_scores_gemma":[0.0013766361,0.00021664277,0.00046367594,0.00873886,0.00026037006,0.00042374778,0.00084021495,0.00029406731,0.0008421471],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018022383,0.000043358163,0.8881523,0.00046529988,0.000327597,0.00019399247,0.0012071164,0.0012168596,0.00039203407,0.0005913954,0.0861171,0.021112828],"study_design_scores_gemma":[0.000004548443,0.000004443964,0.98466957,0.000078566176,0.00003189764,0.00002964642,0.0010475161,0.00023196879,0.00014279904,0.0000349844,0.013716017,0.000007991281],"about_ca_topic_score_codex":0.98484796,"about_ca_topic_score_gemma":0.9940158,"teacher_disagreement_score":0.015152037,"about_ca_system_score_codex":0.009822604,"about_ca_system_score_gemma":0.022211988,"threshold_uncertainty_score":0.07126832},"labels":[],"label_agreement":null},{"id":"W7094271674","doi":"","title":"Tracing the Development of the Virtual Particle Concept Using Semantic Change Detection","year":2024,"lang":"en","type":"other","venue":"PhilSci-Archive (University of Pittsburgh)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Humanities Research Group, University of Windsor; Deutsche Forschungsgemeinschaft","keywords":"Focus (optics); Dependency (UML); Tracing; Parsing; Word (group theory); Scholarship; Development (topology); Term (time); Dependency theory (database theory)","score_opus":0.07384915142221754,"score_gpt":0.307534635972115,"score_spread":0.23368548454989746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7094271674","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5650311,0.00087694963,0.3979311,0.00203684,0.00018062619,0.00031993436,0.0049322876,0.0012179374,0.027473219],"genre_scores_gemma":[0.86937934,0.00020435118,0.12660813,0.00010323522,0.00002384774,0.00017253168,0.0019705738,0.0001954002,0.0013426547],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99805593,0.00090833724,0.00013761313,0.00052471977,0.00029184643,0.00008157998],"domain_scores_gemma":[0.983165,0.012295791,0.0014161833,0.0014195096,0.0014598483,0.00024366727],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.0035701864,0.00044006607,0.00028555113,0.0056075766,0.00097239617,0.0029981025,0.0006940309,0.00077943923,0.0036869193],"category_scores_gemma":[0.021908207,0.00022217071,0.0005261174,0.0048197466,0.0023890224,0.0072852764,0.002489345,0.0013313905,0.0007146516],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004791675,0.00033719628,0.16675939,0.0012919591,0.00016720372,0.000925326,0.03530335,0.008923682,0.0124005005,0.33874238,0.012222053,0.42244777],"study_design_scores_gemma":[0.000054265085,0.0001700311,0.10170914,0.00046437682,0.00020509744,0.0012156994,0.023950726,0.25720438,0.022539247,0.50164187,0.09060926,0.00023593765],"about_ca_topic_score_codex":0.004745488,"about_ca_topic_score_gemma":0.0056165066,"teacher_disagreement_score":0.9990276,"about_ca_system_score_codex":0.0015667874,"about_ca_system_score_gemma":0.001260574,"threshold_uncertainty_score":0.018881142},"labels":[],"label_agreement":null},{"id":"W7095404564","doi":"","title":"Applying Topic Maps to the Classification of Health Interventions Applying Topic Maps to the Classification of Health Interventions","year":2001,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Topic model; Topic Maps; Psychological intervention; Public health; Health information; Health informatics","score_opus":0.23583002330886957,"score_gpt":0.4718574706556981,"score_spread":0.23602744734682854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7095404564","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018025886,0.00267973,0.9688149,0.0024738028,0.00030307888,0.00069666735,0.0024290471,0.0012959953,0.0032809793],"genre_scores_gemma":[0.18527707,0.002670261,0.803535,0.00033928172,0.0005305576,0.0015689163,0.0041499594,0.00023929753,0.0016895983],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98020554,0.01250365,0.001780153,0.0020952409,0.0028808971,0.00053442555],"domain_scores_gemma":[0.9307225,0.060609628,0.0019988867,0.0028924667,0.003206304,0.00057026156],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016028808,0.0019103204,0.002391658,0.017686473,0.0019366265,0.0067786765,0.0018073105,0.0023931412,0.0027063282],"category_scores_gemma":[0.07522996,0.00081756694,0.0039208955,0.013800855,0.0020342197,0.005377896,0.0037428255,0.0033345325,0.0007416988],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00056363654,0.00037572827,0.022253817,0.0027502454,0.0016963182,0.0004707312,0.005692364,0.130381,0.0019682643,0.11562185,0.01951528,0.69871074],"study_design_scores_gemma":[0.00015190641,0.00015456649,0.008995125,0.00060411607,0.00052327133,0.0003124995,0.0021908688,0.52401274,0.0030033845,0.43152317,0.028309384,0.00021897169],"about_ca_topic_score_codex":0.018447373,"about_ca_topic_score_gemma":0.015143431,"teacher_disagreement_score":0.018447373,"about_ca_system_score_codex":0.0026090378,"about_ca_system_score_gemma":0.004359488,"threshold_uncertainty_score":0.08476943},"labels":[],"label_agreement":null},{"id":"W7098031366","doi":"","title":"Computational Identification of Ideology in Text: A Study of Canadian Parliamentary Debates","year":2009,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Ideology; Parliament; Identification (biology); Task (project management); Limiting","score_opus":0.03374563523354474,"score_gpt":0.36176092590709613,"score_spread":0.3280152906735514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7098031366","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9871924,0.00067223754,0.0037599064,0.0012542676,0.000021656635,0.000094097166,0.0015654769,0.0000927928,0.0053472663],"genre_scores_gemma":[0.98631996,0.00025344235,0.008482207,0.00018393625,0.000034173987,0.0000790171,0.0027454423,0.00003452798,0.0018671491],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9969259,0.0012006599,0.00009659172,0.0003954546,0.0010578204,0.00032360083],"domain_scores_gemma":[0.9691003,0.025014423,0.0014617374,0.00082287414,0.0031100381,0.0004905459],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0039038663,0.0005420318,0.0006510026,0.0036836627,0.00590432,0.002498183,0.0019312431,0.0012157005,0.0018699158],"category_scores_gemma":[0.03793704,0.00029574218,0.0005609647,0.0071043484,0.0029921562,0.0017798345,0.0009877458,0.0013448508,0.00041440755],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002092006,0.0012991524,0.41784418,0.0016751632,0.00045647178,0.0025160552,0.10609314,0.045805153,0.014042733,0.05961875,0.032755222,0.31580195],"study_design_scores_gemma":[0.0002354731,0.000214686,0.5310737,0.00029191727,0.00023881282,0.0008166537,0.06420126,0.32746032,0.007959301,0.017059812,0.050121922,0.00032623278],"about_ca_topic_score_codex":0.88304734,"about_ca_topic_score_gemma":0.9171706,"teacher_disagreement_score":0.11695266,"about_ca_system_score_codex":0.020344462,"about_ca_system_score_gemma":0.011191844,"threshold_uncertainty_score":0.23528278},"labels":[],"label_agreement":null},{"id":"W7100013826","doi":"","title":"of Labor Dynamics of Disability and Work in Canada","year":2012,"lang":"en","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"","score_opus":0.020316782903291638,"score_gpt":0.33158860289992986,"score_spread":0.3112718199966382,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7100013826","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9683373,0.001363349,0.0003312251,0.004435356,0.00004864825,0.000040246443,0.01983162,0.000023337547,0.0055889925],"genre_scores_gemma":[0.98953587,0.0007486027,0.00021232993,0.00014141311,0.000013377714,0.000019239527,0.0040162625,0.000009993984,0.005302918],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989831,0.000112254085,0.000048184116,0.0001333143,0.0002558682,0.00046723188],"domain_scores_gemma":[0.99687356,0.00053984154,0.00035945,0.00008159251,0.0013275291,0.00081798155],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0008280204,0.00024232476,0.00042942312,0.0025576476,0.0029056226,0.0024292588,0.0013318203,0.00062237494,0.005734236],"category_scores_gemma":[0.0044164215,0.00028719121,0.00057399785,0.006231291,0.0007520836,0.000892164,0.0014562426,0.0013682435,0.00042724228],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018587343,0.00012739479,0.94978344,0.000073914045,0.00011081579,0.00021110763,0.0053294227,0.0025093572,0.00018439336,0.005298643,0.013810109,0.022375535],"study_design_scores_gemma":[0.000012593184,0.000016809006,0.97274697,0.00007036787,0.00002916607,0.00003091119,0.013602131,0.0041466793,0.0000885446,0.0006800949,0.008545498,0.000030227458],"about_ca_topic_score_codex":0.9987464,"about_ca_topic_score_gemma":0.9989083,"teacher_disagreement_score":0.99426574,"about_ca_system_score_codex":0.044391647,"about_ca_system_score_gemma":0.07727557,"threshold_uncertainty_score":0.32208544},"labels":[],"label_agreement":null},{"id":"W7104462856","doi":"10.71781/21593","title":"Les mises en forme algorithmiques, ruptures et continuités dans la quantification du social","year":2021,"lang":"fr","type":"dissertation","venue":"Papyrus : Institutional Repository (Université de Montréal)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Context (archaeology); Statistical analysis; Structuralism (philosophy of science)","score_opus":0.014499123329631793,"score_gpt":0.2608084759284767,"score_spread":0.24630935259884493,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7104462856","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039194748,0.005477151,0.9280643,0.0102771,0.00033986435,0.0000991815,0.0003338825,0.00054612913,0.01566762],"genre_scores_gemma":[0.4063954,0.0063164327,0.57221496,0.00084447506,0.00054885127,0.00069945405,0.00055228756,0.0005353156,0.011892869],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9704311,0.013251732,0.0018148433,0.006584443,0.007294409,0.0006235723],"domain_scores_gemma":[0.86186147,0.10025243,0.0068640085,0.01780942,0.012200669,0.0010120397],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.03711425,0.0016194569,0.0016348618,0.00755364,0.003352365,0.020400671,0.003969605,0.0045110965,0.005166846],"category_scores_gemma":[0.15357877,0.0017331624,0.0026660946,0.007542846,0.019430153,0.028271277,0.006199884,0.006562365,0.0017068775],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012342223,0.000057825324,0.0113952225,0.00072702474,0.00029108403,0.000100084486,0.008592645,0.025188277,0.0013101525,0.80838305,0.0023338378,0.14149731],"study_design_scores_gemma":[0.000028218778,0.000099894576,0.004591471,0.00060944166,0.00011875022,0.0002849455,0.0035691264,0.10403338,0.0034691147,0.83636856,0.046641823,0.00018525372],"about_ca_topic_score_codex":0.0061047967,"about_ca_topic_score_gemma":0.004341079,"teacher_disagreement_score":0.99664766,"about_ca_system_score_codex":0.006291995,"about_ca_system_score_gemma":0.0045866217,"threshold_uncertainty_score":0.19628125},"labels":[],"label_agreement":null},{"id":"W7105737027","doi":"10.48694/jcls.4168","title":"Towards a Perspectival Moral History of the Novel Using LLMs","year":2025,"lang":"","type":"article","venue":"TUjournals","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Narrative; Inference; Situated; Interpretation (philosophy); Expression (computer science); Plot (graphics); Value (mathematics); Moral disengagement","score_opus":0.14775075654288508,"score_gpt":0.41103372530654103,"score_spread":0.263282968763656,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7105737027","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.103484355,0.0011094185,0.83313996,0.006041156,0.00015943761,0.00021971065,0.0012414184,0.00092223554,0.05368229],"genre_scores_gemma":[0.78043514,0.00041311458,0.21396478,0.00022867753,0.000083761675,0.00023959397,0.0007103177,0.0003304387,0.0035942676],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9958817,0.0031419664,0.000112417845,0.00047160633,0.0003041222,0.00008813021],"domain_scores_gemma":[0.985255,0.010986838,0.0013519384,0.0017166433,0.0003911855,0.00029824788],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054538455,0.00063152116,0.00045954526,0.0043985904,0.0023287924,0.013404857,0.0014732246,0.0011782696,0.006166937],"category_scores_gemma":[0.026416175,0.0005830314,0.0007439609,0.0026463897,0.009313197,0.016459566,0.004931399,0.0025363802,0.0007536221],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000043992124,0.000021487785,0.0023849625,0.00020756057,0.000025229832,0.0001374769,0.0483259,0.004241844,0.00068481045,0.9128527,0.0014523157,0.029621735],"study_design_scores_gemma":[0.000010346993,0.000019303865,0.001603328,0.00025773662,0.000018790559,0.0001819267,0.02350401,0.04165924,0.0010070027,0.87294155,0.05876395,0.000032804368],"about_ca_topic_score_codex":0.0023444523,"about_ca_topic_score_gemma":0.003915045,"teacher_disagreement_score":0.013404857,"about_ca_system_score_codex":0.0031537048,"about_ca_system_score_gemma":0.0017820393,"threshold_uncertainty_score":0.028842986},"labels":[],"label_agreement":null},{"id":"W7117548183","doi":"10.18280/isi.301108","title":"HyNeCo: A Hybrid Neural-Contextual Recommender for Indonesia’s Digital Traditional Markets","year":2025,"lang":"","type":"article","venue":"Ingénierie des systèmes d information","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Recommender system; Key (lock); Feature (linguistics); Field (mathematics)","score_opus":0.0387804862186655,"score_gpt":0.29824297404817324,"score_spread":0.25946248782950776,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7117548183","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5186852,0.006028423,0.3497808,0.0029381576,0.0014835884,0.0008791822,0.009366511,0.018288406,0.09254981],"genre_scores_gemma":[0.7605549,0.001050579,0.17330164,0.0004983848,0.0001891789,0.0001620599,0.006340024,0.00029073027,0.057612404],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9997254,0.000053062307,0.000015394075,0.0000784599,0.0000870584,0.00004062883],"domain_scores_gemma":[0.9995894,0.000113815324,0.000019805715,0.00008950472,0.000121015946,0.00006640081],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005408615,0.00062885444,0.00077347335,0.0007090505,0.00065840525,0.0010915997,0.0011734349,0.00093427644,0.010781511],"category_scores_gemma":[0.0015308369,0.00025142136,0.00047355882,0.0007769239,0.00016935018,0.002110234,0.00095198443,0.0009060744,0.00322388],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017608767,0.0021074836,0.023961317,0.00064515596,0.00042645255,0.0006529906,0.00034923878,0.06436073,0.009108918,0.012346978,0.10156899,0.7827109],"study_design_scores_gemma":[0.00018658223,0.00037985822,0.0076553444,0.000045928075,0.00016676083,0.0002254865,0.0002958556,0.9366756,0.0036877298,0.004989063,0.04559463,0.00009726238],"about_ca_topic_score_codex":0.019334609,"about_ca_topic_score_gemma":0.058366053,"teacher_disagreement_score":0.019334609,"about_ca_system_score_codex":0.00047462914,"about_ca_system_score_gemma":0.00095462066,"threshold_uncertainty_score":0.03844416},"labels":[],"label_agreement":null},{"id":"W7125213011","doi":"10.25949/31093552","title":"Fairness Evaluation and Inference Level Mitigation in LLMs","year":2025,"lang":"","type":"dissertation","venue":"Open MIND","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Politics; Ideology; Ethnic group; Inference; Salient; Cultural bias; Cultural diversity; Convergence (economics)","score_opus":0.20852801699933812,"score_gpt":0.5219760850522652,"score_spread":0.31344806805292713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7125213011","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06331876,0.0010258446,0.922799,0.003134658,0.0003110362,0.00045714495,0.00033619968,0.0022475482,0.006369945],"genre_scores_gemma":[0.7392378,0.00023454195,0.25440553,0.0011654817,0.00037594576,0.0003886423,0.00055807026,0.0004287923,0.003205264],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9613914,0.02057577,0.0026443405,0.005329012,0.007996373,0.0020631729],"domain_scores_gemma":[0.8777013,0.088288344,0.006775945,0.013805622,0.0110469265,0.0023819003],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03776319,0.001374606,0.0020250133,0.002167995,0.0031140253,0.006200951,0.0044071223,0.0027677736,0.0048828586],"category_scores_gemma":[0.15793161,0.0010794232,0.0017881477,0.0011575746,0.003997346,0.008686979,0.010346686,0.004386508,0.00084439095],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026249574,0.00052565127,0.040340375,0.001019385,0.0006417312,0.00082903984,0.004140419,0.22799574,0.010940893,0.28892592,0.009746135,0.41226968],"study_design_scores_gemma":[0.00010641014,0.00017326383,0.0019763135,0.00012692813,0.00013637128,0.0001432252,0.00040918973,0.6868287,0.0073304656,0.29834935,0.0043602246,0.00005961877],"about_ca_topic_score_codex":0.006510852,"about_ca_topic_score_gemma":0.0075522787,"teacher_disagreement_score":0.03776319,"about_ca_system_score_codex":0.0045993924,"about_ca_system_score_gemma":0.008144357,"threshold_uncertainty_score":0.19971323},"labels":[],"label_agreement":null},{"id":"W7133098856","doi":"","title":"Natural Language Processing (NLP) For Ethical Artificial Intelligence (AI)","year":2025,"lang":"en","type":"dissertation","venue":"Trepo - Institutional Repository of Tampere University","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Latent Dirichlet allocation; Topic model; Perception; Ethical issues; Thematic analysis; Identification (biology); Natural language understanding; Software deployment","score_opus":0.03235354115550524,"score_gpt":0.3697557667082658,"score_spread":0.33740222555276056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7133098856","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0148359835,0.025763048,0.8149869,0.046586517,0.004383771,0.0017183701,0.015020495,0.004702234,0.07200273],"genre_scores_gemma":[0.14422062,0.026241852,0.7655262,0.009356193,0.003805107,0.0043827994,0.022761507,0.0013658096,0.022340002],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99180776,0.0045258543,0.00075587066,0.0012773204,0.0014591757,0.00017394766],"domain_scores_gemma":[0.96400136,0.02834003,0.0020297763,0.0027834016,0.0024613405,0.0003840367],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008416081,0.00085052766,0.0008965531,0.0044010594,0.001932281,0.0070929755,0.001332673,0.002351513,0.018103946],"category_scores_gemma":[0.034179185,0.00054811785,0.0013792457,0.0048120287,0.002603531,0.008049151,0.004221659,0.004772988,0.012508533],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013693672,0.00017005051,0.0029067837,0.004244692,0.00014508492,0.0007174766,0.0029451207,0.003887322,0.011484334,0.2102102,0.12977166,0.6333803],"study_design_scores_gemma":[0.00004203178,0.00010999359,0.0039746724,0.0021755865,0.000057289344,0.0010366224,0.002886577,0.041247014,0.005523907,0.38789216,0.5549403,0.00011394866],"about_ca_topic_score_codex":0.001995041,"about_ca_topic_score_gemma":0.0018484426,"teacher_disagreement_score":0.018103946,"about_ca_system_score_codex":0.0018667751,"about_ca_system_score_gemma":0.0039783265,"threshold_uncertainty_score":0.060563743},"labels":[],"label_agreement":null},{"id":"W7134191077","doi":"10.5281/zenodo.18908371","title":"Natural Language Processing Challenges and Opportunities for African Languages in Sierra Leone Context,","year":2010,"lang":"en","type":"article","venue":"Open MIND","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Sierra leone; Scope (computer science); Languages of Africa; Inclusion (mineral); Process (computing); Resource (disambiguation); Limiting","score_opus":0.15189480126668997,"score_gpt":0.42850702454905176,"score_spread":0.2766122232823618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7134191077","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.074831165,0.82819366,0.0060956087,0.071930945,0.0012690977,0.00031737654,0.0012810032,0.00005790739,0.016023187],"genre_scores_gemma":[0.37013575,0.5935187,0.021323828,0.010595708,0.0004983375,0.0009559707,0.0008873751,0.000045992158,0.0020383813],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.992086,0.00557636,0.0008398003,0.00045793352,0.0006465804,0.00039335692],"domain_scores_gemma":[0.9744028,0.021900242,0.0016070768,0.00032861697,0.0015159156,0.0002455242],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012554392,0.00056783255,0.0010945038,0.006533827,0.0025230353,0.0063748565,0.0011173509,0.001715311,0.003987944],"category_scores_gemma":[0.033253003,0.00046486376,0.0010300841,0.0069795093,0.0033873601,0.008013877,0.002364208,0.0018943362,0.00029239358],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024081796,0.000095370284,0.023970919,0.18809913,0.0007434195,0.008282177,0.0922863,0.0012897035,0.002340696,0.08665346,0.019705301,0.57629275],"study_design_scores_gemma":[0.00007656275,0.00015910306,0.033356044,0.2504706,0.0012313417,0.004243509,0.18290521,0.00081721076,0.0012989795,0.04697859,0.47834188,0.00012096894],"about_ca_topic_score_codex":0.024944933,"about_ca_topic_score_gemma":0.06648726,"teacher_disagreement_score":0.024944933,"about_ca_system_score_codex":0.0034919314,"about_ca_system_score_gemma":0.017797912,"threshold_uncertainty_score":0.06639475},"labels":[],"label_agreement":null},{"id":"W7134197168","doi":"10.5281/zenodo.18908372","title":"Natural Language Processing Challenges and Opportunities for African Languages in Sierra Leone Context,","year":2010,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Sierra leone; Scope (computer science); Languages of Africa; Inclusion (mineral); Process (computing); Resource (disambiguation); Limiting","score_opus":0.09816612119781166,"score_gpt":0.3440154371553577,"score_spread":0.24584931595754606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7134197168","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.074831165,0.82819366,0.0060956087,0.071930945,0.0012690977,0.00031737654,0.0012810032,0.00005790739,0.016023187],"genre_scores_gemma":[0.37013575,0.5935187,0.021323828,0.010595708,0.0004983375,0.0009559707,0.0008873751,0.000045992158,0.0020383813],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.992086,0.00557636,0.0008398003,0.00045793352,0.0006465804,0.00039335692],"domain_scores_gemma":[0.9744028,0.021900242,0.0016070768,0.00032861697,0.0015159156,0.0002455242],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012554392,0.00056783255,0.0010945038,0.006533827,0.0025230353,0.0063748565,0.0011173509,0.001715311,0.003987944],"category_scores_gemma":[0.033253003,0.00046486376,0.0010300841,0.0069795093,0.0033873601,0.008013877,0.002364208,0.0018943362,0.00029239358],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024081796,0.000095370284,0.023970919,0.18809913,0.0007434195,0.008282177,0.0922863,0.0012897035,0.002340696,0.08665346,0.019705301,0.57629275],"study_design_scores_gemma":[0.00007656275,0.00015910306,0.033356044,0.2504706,0.0012313417,0.004243509,0.18290521,0.00081721076,0.0012989795,0.04697859,0.47834188,0.00012096894],"about_ca_topic_score_codex":0.024944933,"about_ca_topic_score_gemma":0.06648726,"teacher_disagreement_score":0.024944933,"about_ca_system_score_codex":0.0034919314,"about_ca_system_score_gemma":0.017797912,"threshold_uncertainty_score":0.06639475},"labels":[],"label_agreement":null},{"id":"W7144764961","doi":"","title":"A Review of a Quarter Century of Publication Trends in Language Testing and Assessment : A Topic Modeling Approach","year":2024,"lang":"en","type":"article","venue":"Institutional Repositories DataBase (IRDB)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Topic model; Quarter (Canadian coin); Test (biology)","score_opus":0.06445516671204292,"score_gpt":0.40410554205194693,"score_spread":0.339650375339904,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7144764961","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014194023,0.9708718,0.003249142,0.020169016,0.0016092368,0.000034826437,0.00081168464,0.00008826964,0.0017465808],"genre_scores_gemma":[0.010827969,0.97171885,0.007229597,0.0057626534,0.002382601,0.00009223045,0.0009516225,0.00010576775,0.00092867133],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.98913467,0.0036158906,0.0030190167,0.0010890925,0.0029132713,0.0002279758],"domain_scores_gemma":[0.83633214,0.12969233,0.009967508,0.002224928,0.020281704,0.0015014439],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.021415666,0.0006881111,0.0017434923,0.024483142,0.00067314913,0.0048711766,0.0015188595,0.0017338952,0.0034120898],"category_scores_gemma":[0.07988934,0.0005560123,0.0016850493,0.025415694,0.0014060442,0.007957503,0.0013782122,0.0022572554,0.0014637065],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013185712,0.000064000626,0.004359204,0.033376116,0.0003940008,0.00012925868,0.0009414255,0.00046643376,0.00062134524,0.0063549983,0.09800645,0.85515493],"study_design_scores_gemma":[0.000039720635,0.00018248783,0.019007992,0.09049921,0.0015781933,0.0009548921,0.0017603182,0.0013935864,0.0011686442,0.009941345,0.87335473,0.0001188502],"about_ca_topic_score_codex":0.004996848,"about_ca_topic_score_gemma":0.012587201,"teacher_disagreement_score":0.97858435,"about_ca_system_score_codex":0.0026836847,"about_ca_system_score_gemma":0.008221454,"threshold_uncertainty_score":0.11325824},"labels":[],"label_agreement":null},{"id":"W7149223452","doi":"","title":"Something Happened to the Future: Reconstructing Temporalities in Dutch Parliamentary Debate, 1814–2018","year":2021,"lang":"en","type":"article","venue":"Utrecht University Repository (Utrecht University)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Temporalities; Conceptualization; Politics; Character (mathematics); Ambiguity; Synonym (taxonomy); Quarter (Canadian coin); Temporality","score_opus":0.021905147010650126,"score_gpt":0.2515894757897464,"score_spread":0.22968432877909625,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7149223452","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.88061684,0.009026037,0.005832607,0.004713123,0.0003198723,0.00006232371,0.0067935796,0.000038759976,0.09259679],"genre_scores_gemma":[0.9888192,0.0016169251,0.0009218525,0.000107276544,0.000055924087,0.000049965503,0.0028654055,0.00013825117,0.005425241],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9981832,0.00066400773,0.00015674312,0.00035333118,0.00044076267,0.00020193736],"domain_scores_gemma":[0.9961959,0.0021162063,0.00063953194,0.00019731467,0.00069404184,0.00015708031],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002354039,0.00019854981,0.00035362816,0.00324312,0.0021073201,0.0051678414,0.00070864044,0.0007877597,0.0055634337],"category_scores_gemma":[0.015424111,0.0003480328,0.00023518963,0.0063135596,0.0039041277,0.0071139378,0.0029398787,0.0012335442,0.0008908407],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028460447,0.000048403126,0.048954617,0.00076731964,0.00008844408,0.0019766688,0.76770955,0.0009148692,0.0023354827,0.09873316,0.013829423,0.06435749],"study_design_scores_gemma":[0.0000205917,0.000018003477,0.17899616,0.0012588727,0.000045030054,0.0005731567,0.35063463,0.0020598967,0.0012777072,0.019435683,0.44559383,0.00008640474],"about_ca_topic_score_codex":0.1043877,"about_ca_topic_score_gemma":0.1784874,"teacher_disagreement_score":0.1043877,"about_ca_system_score_codex":0.0067934254,"about_ca_system_score_gemma":0.002330172,"threshold_uncertainty_score":0.20756018},"labels":[],"label_agreement":null},{"id":"W7160242491","doi":"10.69513/ilcr.v3.i2.a5","title":"Tracing the Lexicon of War: A Diachronic NLP Study of Iraqi Newspapers (1980–2025)","year":2025,"lang":"","type":"article","venue":"Iraqi Literary and Cultural Review (ILCR)","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Lexicon; Newspaper; Collocation (remote sensing); Glory; Victory; Tracing; Lexicalization; Arabic","score_opus":0.0438268322180439,"score_gpt":0.3906705944333851,"score_spread":0.3468437622153412,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7160242491","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97125626,0.0016806441,0.0010527287,0.0007598692,0.000040747585,0.00009702941,0.01171477,0.00003934651,0.013358721],"genre_scores_gemma":[0.9790222,0.0013029921,0.0032426629,0.00016619456,0.00008075826,0.00018738523,0.012863315,0.00004402659,0.0030903916],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9994734,0.00013914662,0.000062110325,0.00012959208,0.00013998593,0.000055844015],"domain_scores_gemma":[0.9948329,0.0027809695,0.0011208755,0.00018710535,0.00093525473,0.00014303284],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008620979,0.0002150105,0.00015515789,0.006255495,0.0008889146,0.0012603009,0.0003407409,0.00028987354,0.0022715675],"category_scores_gemma":[0.0058222474,0.00019895914,0.0001697398,0.010099784,0.0009430665,0.0016954892,0.00093757943,0.00048327036,0.0010191135],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006344279,0.0004363138,0.45559132,0.0027700022,0.00014240778,0.0039372486,0.175367,0.0016784323,0.02220583,0.011147862,0.025855588,0.3002335],"study_design_scores_gemma":[0.000018860614,0.000054735163,0.89417386,0.00018453787,0.000032308537,0.00067028374,0.030064886,0.0018415733,0.0022395677,0.00056771125,0.070122354,0.000029373552],"about_ca_topic_score_codex":0.032760996,"about_ca_topic_score_gemma":0.03851701,"teacher_disagreement_score":0.032760996,"about_ca_system_score_codex":0.0017808117,"about_ca_system_score_gemma":0.00087451894,"threshold_uncertainty_score":0.065140605},"labels":[],"label_agreement":null},{"id":"W7160410202","doi":"10.1145/3786995.3786997","title":"From Transformers Come Themes: Evaluating BERTopic for Qualitative Analysis of Social Media Data","year":2025,"lang":"","type":"article","venue":"","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Latent Dirichlet allocation; Qualitative analysis; Social media; Qualitative research; Qualitative property; Sentence; Relevance (law); Topic model","score_opus":0.31514340789998546,"score_gpt":0.5883443346130658,"score_spread":0.2732009267130803,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7160410202","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5569984,0.00044883636,0.41572636,0.0017774862,0.00014818466,0.011889736,0.0019179832,0.0007492219,0.010343843],"genre_scores_gemma":[0.56118923,0.00018821491,0.41263017,0.00033574254,0.000031594507,0.023731641,0.0007909199,0.00023559445,0.00086702633],"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9181718,0.0718229,0.002553915,0.0027222524,0.0038779965,0.0008511194],"domain_scores_gemma":[0.642356,0.31127873,0.011509269,0.012432486,0.020170348,0.0022532046],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10206804,0.0008577229,0.0006657055,0.0029216711,0.0022422236,0.0043074037,0.0018809019,0.0010425871,0.0045899055],"category_scores_gemma":[0.27763474,0.00053507066,0.0011330309,0.0028179914,0.0042650416,0.005171942,0.0058937524,0.0014097543,0.0006801793],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021484895,0.0006271568,0.027106524,0.006231008,0.00021958369,0.0006133349,0.5672062,0.0072443336,0.01831276,0.03537362,0.004234952,0.33068204],"study_design_scores_gemma":[0.0009729916,0.0036562162,0.050662935,0.004837684,0.0005513826,0.0009545658,0.55389166,0.1441253,0.039074693,0.13207692,0.06856719,0.0006285063],"about_ca_topic_score_codex":0.0017694235,"about_ca_topic_score_gemma":0.0053528007,"teacher_disagreement_score":0.10206804,"about_ca_system_score_codex":0.004271768,"about_ca_system_score_gemma":0.0035182857,"threshold_uncertainty_score":0.53979385},"labels":[],"label_agreement":null},{"id":"W7165199962","doi":"10.6082/6bp61-11w10","title":"Is the News Always Negative? Using Deep Learning to Track News Sentiment During the Covid-19 Pandemic","year":2023,"lang":"en","type":"article","venue":"University of Chicago","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"News media; Politics; Pandemic; News values; Coronavirus disease 2019 (COVID-19); Topic model; News analytics; Focus (optics); Sentiment analysis","score_opus":0.07815302857687048,"score_gpt":0.34752397001439517,"score_spread":0.2693709414375247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7165199962","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9584319,0.002744487,0.015002779,0.0037353202,0.0007444805,0.0000615992,0.0057185213,0.0007581096,0.0128026875],"genre_scores_gemma":[0.9866045,0.0005666394,0.003355571,0.00040734303,0.000352452,0.000019070609,0.005722981,0.000039843337,0.0029316198],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99968636,0.000077185694,0.000024611327,0.000089271634,0.000050307564,0.000072195704],"domain_scores_gemma":[0.99854845,0.00066053943,0.00033211603,0.00006998247,0.00028099844,0.00010789809],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007724318,0.00059609895,0.00032106013,0.0016656338,0.00025701892,0.0015775003,0.0003304336,0.0006028736,0.0010819832],"category_scores_gemma":[0.0040515894,0.00019701007,0.0003350919,0.0009290746,0.00022573271,0.0014065271,0.00049150933,0.0010523434,0.00106055],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001324079,0.0005299739,0.5456056,0.00046647977,0.00056515104,0.0010427274,0.0012618831,0.039001297,0.013815686,0.0017696401,0.058685005,0.33593243],"study_design_scores_gemma":[0.000056187335,0.00018841636,0.12570603,0.00015505271,0.00017057521,0.00021942183,0.0011608986,0.85049766,0.0042764232,0.0034369908,0.014070619,0.000061722894],"about_ca_topic_score_codex":0.011095597,"about_ca_topic_score_gemma":0.018175488,"teacher_disagreement_score":0.011095597,"about_ca_system_score_codex":0.0005834853,"about_ca_system_score_gemma":0.0004984337,"threshold_uncertainty_score":0.022062004},"labels":[],"label_agreement":null}]}