{"meta":{"query_hash":"802234436123","filters":{"venue":"Linguistics"},"cohort_total":17,"direct_labels_cover":0,"predictions_cover":17,"exported":17,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/802234436123","api":"https://metacan.xera.ac/api/v1/cohort?venue=Linguistics"},"results":[{"id":"W2508414753","doi":"10.1515/ling-2016-0019","title":"The lexicon in Functional Discourse Grammar: Theory, typology, description","year":2016,"lang":"en","type":"article","venue":"Linguistics","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Lexeme; Lexicon; Linguistics; Computer science; Morpheme; Grammar; Natural language processing; Artificial intelligence; Lexical item; Frame (networking); Philosophy","score_opus":0.01899950790440063,"score_gpt":0.28098725840908806,"score_spread":0.2619877505046874,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2508414753","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043378536,0.0082105035,0.5239718,0.017762853,0.00063666695,0.00017204143,0.0006155652,0.00063854863,0.40461347],"genre_scores_gemma":[0.91952425,0.0032041774,0.06030967,0.0011792907,0.00048431003,0.0003984776,0.00054994726,0.0002755597,0.014074402],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9977138,0.0015486062,0.000117012874,0.00019761364,0.0002682383,0.00015479558],"domain_scores_gemma":[0.9973494,0.0017703482,0.00017142283,0.0003660904,0.00025399608,0.0000887477],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024541565,0.00057706836,0.0006303738,0.004965008,0.0018303118,0.0077474355,0.0014374931,0.0021175132,0.0055377977],"category_scores_gemma":[0.0044628894,0.0003404355,0.00067608996,0.004372642,0.015264009,0.011368363,0.002888184,0.0020531397,0.000713696],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000013170867,0.0000011679741,0.00006457016,0.000009119753,6.735732e-7,0.000019132374,0.00033972439,0.0001534474,0.000019717518,0.9975068,0.0003778418,0.001506425],"study_design_scores_gemma":[0.0000038112391,0.0000042967336,0.00008290543,0.000045937893,0.0000023432178,0.00012429568,0.00070644607,0.0028981,0.00009846944,0.97569555,0.020331336,0.0000064227042],"about_ca_topic_score_codex":0.0030403736,"about_ca_topic_score_gemma":0.0017012252,"teacher_disagreement_score":0.0077474355,"about_ca_system_score_codex":0.004887666,"about_ca_system_score_gemma":0.0016851199,"threshold_uncertainty_score":0.035462677},"labels":[],"label_agreement":null},{"id":"W2510591540","doi":"10.1515/ling-2016-0026","title":"Blackfoot causative formation between lexicon and grammar","year":2016,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Lexeme; Linguistics; Lexicon; Morpheme; Grammar; Lexical functional grammar; Lexical item; Verb; Lexical grammar; Causative; Computer science; Emergent grammar; Focus (optics); Argument (complex analysis); Psychology; Relational grammar; Philosophy","score_opus":0.042915326649801425,"score_gpt":0.2532778118619995,"score_spread":0.21036248521219808,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2510591540","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.32811025,0.0010252277,0.37825876,0.0036393995,0.00018560306,0.00008645308,0.00019262743,0.00075679633,0.28774494],"genre_scores_gemma":[0.98353624,0.00013912116,0.012211652,0.00010468139,0.000022085022,0.000021893791,0.000043252832,0.00011451698,0.0038066178],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99926203,0.00036551477,0.000038393522,0.00013311685,0.00011550667,0.000085400585],"domain_scores_gemma":[0.9993154,0.00034128386,0.00007008513,0.000107186126,0.00013713054,0.00002898424],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008715624,0.00042788425,0.0003202311,0.0009798375,0.0013539728,0.003060312,0.0004991797,0.00068856444,0.003929354],"category_scores_gemma":[0.0017785322,0.0002796745,0.00033352227,0.0007028677,0.0056148507,0.00439218,0.002080939,0.00085530756,0.00028728487],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000064432224,0.0000032930234,0.00035898274,0.000019221512,0.0000016667364,0.00011164517,0.002450195,0.00025037123,0.0009843386,0.9902069,0.0002500627,0.005356916],"study_design_scores_gemma":[0.0000088756515,0.000017023538,0.0011286763,0.000056931647,0.000011379598,0.0003947126,0.0027112628,0.0051308484,0.0026879453,0.95575094,0.032086417,0.000015042789],"about_ca_topic_score_codex":0.002906029,"about_ca_topic_score_gemma":0.002713474,"teacher_disagreement_score":0.003929354,"about_ca_system_score_codex":0.0026346294,"about_ca_system_score_gemma":0.0010167146,"threshold_uncertainty_score":0.019115686},"labels":[],"label_agreement":null},{"id":"W2517767936","doi":"10.1515/ling-2015-0017","title":"How multiple past tenses divide the labor: The case of South Baffin Inuktitut","year":2015,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Indeterminacy (philosophy); Icelandic; Linguistics; History; Variety (cybernetics); Simple past; Computer science; Epistemology; Philosophy; Grammar; Artificial intelligence","score_opus":0.054288159743357337,"score_gpt":0.24624292770710746,"score_spread":0.1919547679637501,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2517767936","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9046985,0.00034484925,0.001737328,0.0016677792,0.000018534625,0.000020693302,0.000041564734,0.000021110114,0.09144967],"genre_scores_gemma":[0.996671,0.000035531022,0.0003330916,0.00003379763,0.0000024030637,0.0000046605887,0.000009755881,0.000009270023,0.0029004083],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.999323,0.00028607182,0.000026136078,0.00010316879,0.00008366313,0.00017801845],"domain_scores_gemma":[0.999181,0.00044572298,0.000089392925,0.00008196087,0.000115408766,0.00008659072],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012607276,0.00023886809,0.0003351178,0.0013043315,0.01162353,0.003774836,0.0009107873,0.0009450403,0.0066487645],"category_scores_gemma":[0.0016747804,0.00036217688,0.00018400025,0.001620903,0.009659915,0.0032478848,0.0028072058,0.0012151512,0.0002777337],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014675749,0.000037124086,0.011264608,0.00008387523,0.000014251128,0.003959725,0.6350048,0.0004178139,0.0028992947,0.33284327,0.0012597559,0.012068668],"study_design_scores_gemma":[0.000046690002,0.00006782531,0.04666995,0.00032987853,0.00006948966,0.0023136607,0.7156708,0.0061293216,0.0023086527,0.08026348,0.14601181,0.00011841473],"about_ca_topic_score_codex":0.2751338,"about_ca_topic_score_gemma":0.5114788,"teacher_disagreement_score":0.2751338,"about_ca_system_score_codex":0.011890201,"about_ca_system_score_gemma":0.0025815156,"threshold_uncertainty_score":0.54706466},"labels":[],"label_agreement":null},{"id":"W2546420900","doi":"10.1515/ling-2016-0003","title":"Against Isomorphism and the Maxim of Charity in child language acquisition: Implications for the validity of the TVJT methodology","year":2016,"lang":"en","type":"article","venue":"Linguistics","topic":"Language Development and Disorders","field":"Psychology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"McGill University","keywords":"Maxim; Linguistics; Interpretation (philosophy); Negation; Isomorphism (crystallography); Psychology; Morpheme; Computer science; Natural language processing; Philosophy; Epistemology; Chemistry","score_opus":0.07108231059101608,"score_gpt":0.353755263213052,"score_spread":0.28267295262203596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2546420900","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.68065,0.00036937997,0.15763049,0.0080263205,0.00017862924,0.0001119094,0.0001608052,0.00017889007,0.15269366],"genre_scores_gemma":[0.98880553,0.000057024994,0.009320241,0.00017233349,0.000039238294,0.0000742084,0.000027000124,0.00004896253,0.0014554255],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99115753,0.0057204925,0.00038364824,0.0012138975,0.0009975712,0.0005269163],"domain_scores_gemma":[0.95724434,0.0315649,0.0034406392,0.004646241,0.002157503,0.00094632973],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014965048,0.00051036297,0.0007670405,0.0017804023,0.0012365663,0.0030713244,0.0014303841,0.0012536072,0.009207864],"category_scores_gemma":[0.03649477,0.0005733649,0.0006353989,0.0008342357,0.015300986,0.010078839,0.0046686623,0.004655066,0.00038126702],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014365526,0.00006947781,0.009129208,0.000109941444,0.000033443826,0.00021034155,0.010378622,0.00049493473,0.0019149286,0.9636129,0.00047637985,0.013426062],"study_design_scores_gemma":[0.00007991859,0.0001750669,0.019761847,0.00010541058,0.000086662,0.0005795791,0.014929015,0.009081706,0.0062304153,0.9385227,0.0103807375,0.00006693343],"about_ca_topic_score_codex":0.0015187807,"about_ca_topic_score_gemma":0.001840051,"teacher_disagreement_score":0.014965048,"about_ca_system_score_codex":0.0012323228,"about_ca_system_score_gemma":0.0016890214,"threshold_uncertainty_score":0.07914364},"labels":[],"label_agreement":null},{"id":"W2547732919","doi":"10.1515/ling-2015-0044","title":"Uniqueness and grammatical relations in Upper Necaxa Totonac","year":2016,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Uniqueness; Axiom; Linguistics; Object (grammar); Universal grammar; Grammar; Relation (database); Agreement; Mathematics; Computer science; Philosophy","score_opus":0.023817369128572078,"score_gpt":0.24477048544828303,"score_spread":0.22095311631971096,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2547732919","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7503796,0.00044883398,0.010043103,0.0012078538,0.00011115026,0.00007752874,0.00027300479,0.000084753716,0.23737408],"genre_scores_gemma":[0.9937704,0.000040924588,0.0022020198,0.000060230966,0.000008553744,0.000015394477,0.00009168321,0.000028469713,0.0037822952],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.999308,0.0001659519,0.00006075953,0.00017510571,0.00018700837,0.00010312731],"domain_scores_gemma":[0.998028,0.00096734613,0.00021397002,0.00026307497,0.00041525444,0.00011248846],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00089987845,0.00022360818,0.00043786943,0.0011864738,0.0037736401,0.0026819664,0.00058784435,0.0007593966,0.007215265],"category_scores_gemma":[0.0027470316,0.0002197113,0.00020229121,0.0015862965,0.00549311,0.002489366,0.0024484221,0.0011286535,0.00039932292],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023015523,0.000050395687,0.009318093,0.00012672086,0.000016479862,0.0020800051,0.0336727,0.0004756353,0.014449503,0.91463923,0.0015761305,0.02336495],"study_design_scores_gemma":[0.000087222405,0.00018406245,0.0796802,0.00029262068,0.0001009444,0.006134476,0.04933331,0.007973824,0.017010823,0.5954245,0.24358688,0.0001911792],"about_ca_topic_score_codex":0.0128890695,"about_ca_topic_score_gemma":0.022870673,"teacher_disagreement_score":0.0128890695,"about_ca_system_score_codex":0.00331777,"about_ca_system_score_gemma":0.0010337639,"threshold_uncertainty_score":0.02562809},"labels":[],"label_agreement":null},{"id":"W2591714696","doi":"10.1515/ling-2020-0184","title":"Culminating and non-culminating accomplishments in Malagasy","year":2020,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Nederlandse Organisatie voor Wetenschappelijk Onderzoek","keywords":"Circumstantial evidence; Causation; Prefix; Linguistics; History; Epistemology; Philosophy","score_opus":0.034838147866294675,"score_gpt":0.25477925165475795,"score_spread":0.21994110378846327,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2591714696","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93018425,0.0005920506,0.0047606416,0.0011970273,0.000018152323,0.000024595178,0.0001939125,0.000061011517,0.062968396],"genre_scores_gemma":[0.99904114,0.0000723014,0.0003670905,0.000018805235,0.0000026972382,0.0000051326238,0.000020619522,0.00000645448,0.00046577773],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99972326,0.00009879741,0.000022843582,0.000048724374,0.000050383263,0.000055931432],"domain_scores_gemma":[0.99923396,0.00036685792,0.00022281986,0.00006815508,0.00008012287,0.00002796196],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00035485122,0.00022923991,0.0001990787,0.00074453896,0.0017069256,0.0019557627,0.000283575,0.0003113072,0.0036484508],"category_scores_gemma":[0.000993904,0.0001939637,0.00012600474,0.0014605848,0.004254193,0.0019858642,0.0022247,0.00051634584,0.00011225143],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001528386,0.00003382528,0.027098848,0.00036800446,0.00005044371,0.0026500279,0.093959935,0.0012421963,0.008660155,0.83407354,0.0011669478,0.030543262],"study_design_scores_gemma":[0.00007086946,0.00024584206,0.2588522,0.0004935278,0.00021622097,0.004064342,0.17207769,0.012407418,0.013438456,0.2820238,0.25592574,0.00018392055],"about_ca_topic_score_codex":0.011913248,"about_ca_topic_score_gemma":0.014530847,"teacher_disagreement_score":0.011913248,"about_ca_system_score_codex":0.0017724533,"about_ca_system_score_gemma":0.00051761256,"threshold_uncertainty_score":0.02368778},"labels":[],"label_agreement":null},{"id":"W2760562865","doi":"10.1515/ling-2017-0019","title":"The development of gender-specific patterns in the production of voiceless sibilant fricatives in Mandarin Chinese","year":2017,"lang":"en","type":"article","venue":"Linguistics","topic":"Phonetics and Phonology Research","field":"Psychology","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge","funders":"","keywords":"Mandarin Chinese; Variation (astronomy); Articulation (sociology); Psychology; Speech production; Linguistics; Repetition (rhetorical device); Phonological development; Phonology","score_opus":0.09231072968453163,"score_gpt":0.39954172846112157,"score_spread":0.30723099877658994,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2760562865","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9993387,0.000056473284,0.000079496764,0.000004241224,0.0000017069302,0.0000032153382,0.000047721962,0.0000026686944,0.00046581382],"genre_scores_gemma":[0.9991398,0.0000718606,0.00018967754,0.000006567428,0.0000017534726,0.0000083785235,0.00009994255,0.0000034690327,0.00047845495],"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","domain_scores_codex":[0.9997669,0.000022985401,0.00002482794,0.00007034512,0.00007074833,0.00004416155],"domain_scores_gemma":[0.9992029,0.00018418067,0.00027100032,0.000052058316,0.00018110815,0.00010888693],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00043961554,0.0002482869,0.00020347857,0.00090428,0.00024101623,0.00038296726,0.00021958689,0.00026598037,0.0013833217],"category_scores_gemma":[0.0010924814,0.0002492886,0.0002113414,0.00021573745,0.00045678634,0.00020898788,0.00040413556,0.00017515886,0.00031378213],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046191376,0.00006345529,0.36797062,0.00010874028,0.00004075307,0.0021547903,0.007570048,0.000102633254,0.59725976,0.00013953383,0.00009074281,0.024037015],"study_design_scores_gemma":[0.0000021148555,0.00014322047,0.9886952,0.000005045805,0.000009369506,0.0005399162,0.0007679914,0.000046243753,0.009552929,0.000018242647,0.00021229932,0.000007586818],"about_ca_topic_score_codex":0.004143787,"about_ca_topic_score_gemma":0.006479607,"teacher_disagreement_score":0.004143787,"about_ca_system_score_codex":0.00020568787,"about_ca_system_score_gemma":0.00028950127,"threshold_uncertainty_score":0.008239329},"labels":[],"label_agreement":null},{"id":"W2782848721","doi":"10.1515/ling-2017-0032","title":"Reproducible research in linguistics: A position statement on data citation and attribution in our field","year":2017,"lang":"en","type":"article","venue":"Linguistics","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":172,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Science Foundation","keywords":"Attribution; Linguistics; Statement (logic); Citation; Field (mathematics); Applied linguistics; Quantitative linguistics; Authorship attribution; Position statement; Clinical linguistics; Psychology; Computer science; Sociology; Philosophy; Social psychology; Library science; Medicine","score_opus":0.18682001548247734,"score_gpt":0.4697376448389886,"score_spread":0.28291762935651127,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2782848721","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00050865597,0.004595578,0.026413327,0.90869933,0.05399496,0.00013873051,0.00011911522,0.00026714776,0.0052631265],"genre_scores_gemma":[0.0830136,0.014681828,0.118276596,0.55096275,0.20411709,0.0028595997,0.0006792421,0.0022234935,0.023185944],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.42414463,0.2677759,0.093188375,0.03858541,0.16420946,0.01209629],"domain_scores_gemma":[0.08779371,0.5594523,0.060614813,0.1008102,0.16545716,0.025871834],"candidate_categories":["metaresearch","open_science"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5745385,0.0024990458,0.007002002,0.013322383,0.028915191,0.0797623,0.013923496,0.09473223,0.0064599235],"category_scores_gemma":[0.7133316,0.0032559156,0.0042127846,0.01796038,0.09172913,0.056500528,0.032720536,0.10039718,0.008033013],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000086423184,0.00006725691,0.0007726867,0.0006451564,0.000111146444,0.00025052362,0.0038941354,0.00042353463,0.00041709244,0.6334046,0.32461333,0.035313983],"study_design_scores_gemma":[0.00009334875,0.00007585415,0.00042396138,0.0029823892,0.00011020769,0.00024501927,0.001318174,0.002043078,0.0012670271,0.41271943,0.57836336,0.00035809973],"about_ca_topic_score_codex":0.005914455,"about_ca_topic_score_gemma":0.0043316972,"teacher_disagreement_score":0.9860765,"about_ca_system_score_codex":0.027429618,"about_ca_system_score_gemma":0.09346701,"threshold_uncertainty_score":0.52466977},"labels":[],"label_agreement":null},{"id":"W2909345388","doi":"10.1515/ling-2018-0034","title":"The use of<i>any</i>with factive predicates","year":2019,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Negation; Emotive; Regret; License; Counterfactual thinking; Linguistics; Grammar; Polarity (international relations); Meaning (existential); Computer science; Psychology; Epistemology; Social psychology; Philosophy","score_opus":0.03779951894372826,"score_gpt":0.2280744792269931,"score_spread":0.19027496028326482,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2909345388","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.90603995,0.003186258,0.011741312,0.0012811208,0.00016400473,0.0000790017,0.0008468208,0.00022859509,0.07643295],"genre_scores_gemma":[0.9953087,0.000759672,0.0016607923,0.00016941702,0.00008858309,0.000020336372,0.0004181491,0.00013254964,0.0014416963],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9971411,0.0011618973,0.00033548338,0.00046030484,0.0007363975,0.00016491202],"domain_scores_gemma":[0.9765887,0.015639847,0.0034625365,0.0023573027,0.0016260216,0.00032559937],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027424672,0.0003105581,0.00036694043,0.0019131035,0.0014427039,0.0030696692,0.000625457,0.0006220674,0.0052844514],"category_scores_gemma":[0.012366522,0.00038251793,0.00033373028,0.0018913669,0.0035124598,0.0073381215,0.0027667326,0.0016031753,0.0010544007],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012095033,0.0002810108,0.23428605,0.0043128985,0.00031865726,0.008603806,0.15009493,0.00037058778,0.12531102,0.12794851,0.013128797,0.33413428],"study_design_scores_gemma":[0.00004736071,0.00037373137,0.4872553,0.0021960344,0.00034609463,0.028940203,0.065769605,0.002418944,0.049755637,0.040615108,0.32204363,0.00023840013],"about_ca_topic_score_codex":0.001399717,"about_ca_topic_score_gemma":0.0014157358,"teacher_disagreement_score":0.0052844514,"about_ca_system_score_codex":0.0006568115,"about_ca_system_score_gemma":0.00049850787,"threshold_uncertainty_score":0.01767826},"labels":[],"label_agreement":null},{"id":"W3004777944","doi":"10.1515/ling-2019-0039","title":"Emphatic consonants beyond Arabic: The emergence and proliferation of uvular-pharyngeal emphasis in Kumzari","year":2020,"lang":"en","type":"article","venue":"Linguistics","topic":"Phonetics and Phonology Research","field":"Psychology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Uppsala Universitet; Universiteit Leiden; Sultan Qaboos University; Alexander von Humboldt-Stiftung","keywords":"Semitic languages; Emphasis (telecommunications); Linguistics; Arabic; Language contact; Phenomenon; History; Vocabulary; Phonology; Computer science; Philosophy","score_opus":0.053120270806025535,"score_gpt":0.3509634372871384,"score_spread":0.29784316648111286,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3004777944","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.992098,0.00019665224,0.00030111457,0.0000774073,0.000009395425,0.0000044869703,0.000013485563,0.000010153056,0.007289413],"genre_scores_gemma":[0.9987097,0.00005999573,0.00021369758,0.000010251187,0.0000049480054,0.0000015692796,0.000009510463,0.0000047759813,0.0009855955],"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","domain_scores_codex":[0.9998549,0.0000330958,0.000008554082,0.000040942992,0.000030905274,0.000031555213],"domain_scores_gemma":[0.99946696,0.00020956206,0.00010640425,0.000045294964,0.00011195055,0.00005976102],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002705617,0.00020987088,0.00020577732,0.00058039394,0.0012641931,0.0011087275,0.00025758808,0.0004048132,0.0030670771],"category_scores_gemma":[0.0010700291,0.0001433122,0.00007119299,0.00045733774,0.0011443518,0.00053894747,0.0009805406,0.00053840625,0.0006362176],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010475661,0.00016162852,0.111637786,0.00053355854,0.000032871667,0.010091219,0.2989936,0.00025993577,0.39958477,0.012447979,0.00084929034,0.16435976],"study_design_scores_gemma":[0.000039407183,0.00063423294,0.79209715,0.00019194918,0.00006719569,0.0090697305,0.10356399,0.0014786999,0.04319133,0.002667212,0.04690756,0.00009152515],"about_ca_topic_score_codex":0.0021504192,"about_ca_topic_score_gemma":0.004880524,"teacher_disagreement_score":0.0030670771,"about_ca_system_score_codex":0.00045398172,"about_ca_system_score_gemma":0.0003832936,"threshold_uncertainty_score":0.010260403},"labels":[],"label_agreement":null},{"id":"W3135677970","doi":"10.1515/ling-2021-0021","title":"Expectations in language processing and production: an introduction to the special issue","year":2021,"lang":"en","type":"article","venue":"Linguistics","topic":"Neurobiology of Language and Bilingualism","field":"Neuroscience","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Norges Forskningsråd; Eberhard Karls Universität Tübingen","keywords":"Linguistics; Production (economics); Computer science; Philosophy; Economics","score_opus":0.02026753532018514,"score_gpt":0.3109884979845905,"score_spread":0.29072096266440534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3135677970","genre_codex":"review","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00029069965,0.5038149,0.0051887967,0.08859631,0.39224035,0.000053853648,0.00033399658,0.00013012422,0.009351057],"genre_scores_gemma":[0.001775713,0.22758886,0.0017137515,0.031104496,0.72411036,0.00011000666,0.00031800428,0.00016589629,0.013112867],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9988709,0.0002722755,0.00020797775,0.00019602463,0.00035369047,0.00009909028],"domain_scores_gemma":[0.9917829,0.005549516,0.00033262867,0.0002013036,0.0014146677,0.0007190928],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003201447,0.002655781,0.003055833,0.0033618752,0.0011547738,0.004060155,0.0020821355,0.0071233134,0.015679838],"category_scores_gemma":[0.008053443,0.0011800706,0.0016993282,0.001636796,0.0024789223,0.0062255124,0.0033683649,0.013043367,0.007942794],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005271563,0.00007144392,0.00024088283,0.0006922054,0.000035502107,0.00031186678,0.00011988133,0.00021578744,0.00039254045,0.0060372637,0.88143444,0.110395566],"study_design_scores_gemma":[0.000027177348,0.00009970066,0.0010561872,0.0016897634,0.000038032227,0.0014641393,0.000116363175,0.00031831057,0.00015176389,0.018277876,0.976695,0.00006572507],"about_ca_topic_score_codex":0.0018816359,"about_ca_topic_score_gemma":0.002904707,"teacher_disagreement_score":0.015679838,"about_ca_system_score_codex":0.002084077,"about_ca_system_score_gemma":0.00185802,"threshold_uncertainty_score":0.052454293},"labels":[],"label_agreement":null},{"id":"W3153295875","doi":"10.1515/ling-2020-0110","title":"Spanish embedded question island effects revisited: an experimental study","year":2021,"lang":"en","type":"article","venue":"Linguistics","topic":"Neurobiology of Language and Bilingualism","field":"Neuroscience","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"The Scarborough Hospital; University of Toronto","funders":"","keywords":"Presupposition; Verb; Focus (optics); Ask price; Constraint (computer-aided design); Bounding overwatch; Linguistics; Contrast (vision); Mathematics; Computer science; Artificial intelligence; Philosophy; Physics; Economics","score_opus":0.024465818251006115,"score_gpt":0.34027008011750454,"score_spread":0.3158042618664984,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3153295875","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98646474,0.00017608976,0.003323955,0.0001527719,0.000056077377,0.00060896593,0.00025095206,0.00009919153,0.008867147],"genre_scores_gemma":[0.98589456,0.0001669787,0.0068934057,0.0005726462,0.000092159185,0.0018830701,0.0005025372,0.00024125876,0.0037534703],"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","domain_scores_codex":[0.99423814,0.0022784427,0.0005660965,0.001767953,0.000879347,0.0002700738],"domain_scores_gemma":[0.941906,0.04246137,0.004038261,0.007786729,0.0028053524,0.0010023405],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056486134,0.0009813892,0.0010704236,0.00046342338,0.000776834,0.0020355463,0.0015043584,0.0018761106,0.009882123],"category_scores_gemma":[0.037721083,0.0008278469,0.0005143689,0.0004589717,0.002329579,0.0023759052,0.0023689654,0.00249322,0.0012292308],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0298542,0.06037017,0.04189152,0.0040403884,0.00054324354,0.0035853493,0.06541113,0.0018951318,0.6526466,0.018575951,0.0042687585,0.11691766],"study_design_scores_gemma":[0.023327637,0.098405935,0.44816297,0.00093847816,0.0019778167,0.006756463,0.019326592,0.02554281,0.23928103,0.075756066,0.05898223,0.0015419432],"about_ca_topic_score_codex":0.001562243,"about_ca_topic_score_gemma":0.0013513571,"teacher_disagreement_score":0.009882123,"about_ca_system_score_codex":0.0006863732,"about_ca_system_score_gemma":0.0006185336,"threshold_uncertainty_score":0.033059},"labels":[],"label_agreement":null},{"id":"W4244767861","doi":"10.1515/ling-2013-0039","title":"“Sometimes I'll start a sentence in Spanish Y TERMINO EN ESPAÑOL”: Toward a typology of code-switching","year":2013,"lang":"en","type":"article","venue":"Linguistics","topic":"Spanish Linguistics and Language Studies","field":"Arts and Humanities","cited_by":41,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Typology; Code-switching; Linguistics; Sentence; Linguistic typology; Syntax; Code (set theory); Philosophy; Psychology; Humanities; History; Sociology; Computer science; Programming language; Anthropology","score_opus":0.02611073656453649,"score_gpt":0.2504161320522807,"score_spread":0.2243053954877442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4244767861","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6439989,0.0004087835,0.06521376,0.0054030023,0.00032657658,0.00014865598,0.0005477893,0.00066123414,0.28329128],"genre_scores_gemma":[0.9907302,0.00008665539,0.004357485,0.0003813677,0.00004540424,0.000072452676,0.00028448316,0.00041555474,0.0036263755],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9962644,0.0021026628,0.00018113972,0.0005075538,0.0005360951,0.00040821827],"domain_scores_gemma":[0.99142694,0.005132606,0.0006269647,0.0011458657,0.0012804535,0.00038719282],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025062356,0.00053166365,0.00036221193,0.0024953126,0.0029248416,0.0049367226,0.0015893219,0.0019540426,0.0041843276],"category_scores_gemma":[0.0098537635,0.00033906996,0.00049500837,0.0022683493,0.00972962,0.0068982234,0.002972625,0.003628768,0.0008230566],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019964216,0.000117594944,0.01994021,0.00016235207,0.00002089521,0.0016662674,0.28684404,0.0005717393,0.007912574,0.63469857,0.007503809,0.040362325],"study_design_scores_gemma":[0.00013534144,0.00012480444,0.03313957,0.00051641086,0.00009851767,0.0049369424,0.40091196,0.0210552,0.012583293,0.35803458,0.16821387,0.0002494261],"about_ca_topic_score_codex":0.016428193,"about_ca_topic_score_gemma":0.011305249,"teacher_disagreement_score":0.016428193,"about_ca_system_score_codex":0.00252991,"about_ca_system_score_gemma":0.0023328264,"threshold_uncertainty_score":0.032665133},"labels":[],"label_agreement":null},{"id":"W4291001811","doi":"10.1515/ling-2020-0211","title":"St’át’imcets frustratives as not-at-issue modals","year":2022,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Leibniz-Gemeinschaft; Social Sciences and Humanities Research Council of Canada; University of British Columbia","keywords":"Linguistics; Proposition; Grammaticality; Philosophy; Causation; Evidentiality; Coreference; Grammar; Epistemology; Computer science; Artificial intelligence","score_opus":0.03677723792240093,"score_gpt":0.268292201424065,"score_spread":0.2315149635016641,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4291001811","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6934982,0.00059077813,0.029759523,0.0021299638,0.00011308004,0.00005404085,0.00029268072,0.00037189553,0.27318993],"genre_scores_gemma":[0.9940078,0.0000493985,0.0013447717,0.00007413655,0.00002250363,0.000012345974,0.000067357854,0.000095306044,0.0043264222],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.9991499,0.000335156,0.000046618883,0.00014433739,0.00019575989,0.00012816959],"domain_scores_gemma":[0.9979798,0.0010645831,0.0002787749,0.000238982,0.00035401701,0.00008386489],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011086774,0.0003338502,0.00031898485,0.0009868109,0.0018471956,0.002469735,0.0005717134,0.00085279206,0.007276608],"category_scores_gemma":[0.0027841984,0.00025045645,0.00029826455,0.00081823417,0.005261339,0.0038361277,0.0029983488,0.0012552991,0.00059983536],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015249901,0.000023402456,0.0054743118,0.00012604352,0.000021936006,0.0007757708,0.07591233,0.00047220034,0.0072900704,0.8882323,0.002186799,0.01933223],"study_design_scores_gemma":[0.00009042537,0.00022937499,0.037362356,0.00042102204,0.0001472243,0.0030233068,0.10464124,0.010779529,0.017738761,0.45952356,0.36579302,0.00025024315],"about_ca_topic_score_codex":0.003963151,"about_ca_topic_score_gemma":0.0055997595,"teacher_disagreement_score":0.007276608,"about_ca_system_score_codex":0.0028541936,"about_ca_system_score_gemma":0.000507926,"threshold_uncertainty_score":0.024342656},"labels":[],"label_agreement":null},{"id":"W4308014841","doi":"10.1515/ling-2020-0035","title":"Non-syntactic factors and accessibility to relativization: evidence from Armenian","year":2022,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Genitive case; Linguistics; Hierarchy; Armenian; Dative case; Demonstrative; Oblique case; Noun phrase; Universal grammar; Grammar; Predicate (mathematical logic); Noun; Mathematics; Philosophy; Computer science; Political science","score_opus":0.056478637433292296,"score_gpt":0.282028371915199,"score_spread":0.22554973448190674,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4308014841","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99439704,0.00029336498,0.00013959184,0.000029524082,0.0000021694595,0.0000051070306,0.00009563486,0.0000032531743,0.0050344467],"genre_scores_gemma":[0.99898833,0.00019525095,0.00013819801,0.00002430606,0.000003960902,0.0000049303676,0.00013154715,0.0000046004575,0.00050889293],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99950993,0.00012211844,0.000048319765,0.00012042415,0.00011210195,0.00008708531],"domain_scores_gemma":[0.99759704,0.0012854756,0.00043174034,0.0003254872,0.00027133842,0.00008893539],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013028986,0.000284646,0.0005494394,0.0013073282,0.0009682738,0.0014140994,0.0005228362,0.00037391004,0.006488623],"category_scores_gemma":[0.0039526504,0.00039640133,0.00021172642,0.0021224793,0.0015718994,0.00072889216,0.0015535074,0.0004513556,0.00048368765],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005132077,0.0005287518,0.44161773,0.0012552419,0.0005615695,0.0029179777,0.19900212,0.000692691,0.16600391,0.015483665,0.0016677311,0.16513655],"study_design_scores_gemma":[0.000028363469,0.00011969366,0.98854476,0.000046392546,0.000058831654,0.0002534659,0.0047471817,0.00018048625,0.0012795402,0.0013412695,0.0033750974,0.00002496221],"about_ca_topic_score_codex":0.04632316,"about_ca_topic_score_gemma":0.050352484,"teacher_disagreement_score":0.04632316,"about_ca_system_score_codex":0.0007914037,"about_ca_system_score_gemma":0.0004244454,"threshold_uncertainty_score":0.09210706},"labels":[],"label_agreement":null},{"id":"W4388233341","doi":"10.1515/ling-2022-0017","title":"Beyond alienability: factors determining possessive classes in Piaroa","year":2023,"lang":"en","type":"article","venue":"Linguistics","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"University of British Columbia; Killam Trusts; Endangered Languages Documentation Programme","keywords":"Possessive; Possession (linguistics); Linguistics; Noun; Noun phrase; Genitive case; History; Philosophy","score_opus":0.0435401410852999,"score_gpt":0.28045475933366903,"score_spread":0.23691461824836912,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388233341","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99141407,0.00007572347,0.0007655859,0.000048966343,0.0000024313663,0.000011116949,0.0000680888,0.0000070444953,0.0076068696],"genre_scores_gemma":[0.9995315,0.000019996556,0.0001645486,0.0000024296614,0.0000015045105,0.000003843075,0.000035736997,0.0000064543788,0.00023393876],"study_design_codex":"observational","study_design_gemma":"qualitative","domain_scores_codex":[0.9988869,0.0003378333,0.0000939533,0.00025920986,0.00023070813,0.00019145847],"domain_scores_gemma":[0.99426115,0.003277987,0.0012592048,0.0005381889,0.00041812367,0.00024535455],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011737931,0.0002444525,0.00028519283,0.0019079463,0.0016718396,0.0022819182,0.0004852155,0.00027678657,0.005280365],"category_scores_gemma":[0.007238014,0.00026000617,0.00015584513,0.0016684278,0.0029637672,0.0025213212,0.0025189633,0.00082810986,0.00027251706],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005811466,0.00011068263,0.74553216,0.00025075444,0.000049375773,0.00096593035,0.16369055,0.00025708898,0.028530236,0.01810882,0.00027490343,0.04164834],"study_design_scores_gemma":[0.000008011199,0.000067497385,0.95075184,0.000063604886,0.000023299215,0.00065710564,0.03881011,0.0005247436,0.0017964893,0.00285712,0.004405641,0.00003449185],"about_ca_topic_score_codex":0.013283384,"about_ca_topic_score_gemma":0.025007036,"teacher_disagreement_score":0.013283384,"about_ca_system_score_codex":0.00077710603,"about_ca_system_score_gemma":0.0004925569,"threshold_uncertainty_score":0.02641213},"labels":[],"label_agreement":null},{"id":"W4408226726","doi":"10.1515/ling-2025-0016","title":"“I haven’t seen any results yet”: on ethical collaborative research in linguistics and the need for a standard protocol","year":2025,"lang":"en","type":"article","venue":"Linguistics","topic":"Language, Discourse, Communication Strategies","field":"Arts and Humanities","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Leverhulme Trust; Trent University; Nottingham Trent University","keywords":"Linguistics; Applied linguistics; Protocol (science); Haven; Clinical linguistics; Psychology; Philosophy; Medicine","score_opus":0.10790292738503555,"score_gpt":0.454158373337925,"score_spread":0.3462554459528895,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408226726","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016058896,0.0035564362,0.48043686,0.2581502,0.018656505,0.19198124,0.00088235957,0.00090073096,0.029376823],"genre_scores_gemma":[0.08250384,0.0022264398,0.30924064,0.08448692,0.0018897533,0.51478827,0.00038072065,0.0004305043,0.004052994],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.109965056,0.8082822,0.043897428,0.006305355,0.028846651,0.0027032895],"domain_scores_gemma":[0.12954512,0.64748734,0.02325644,0.11194784,0.08011082,0.00765248],"candidate_categories":["metaresearch","research_integrity"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.80140644,0.0017084862,0.0042905705,0.0056553534,0.013785203,0.018981898,0.011205703,0.01839435,0.009793452],"category_scores_gemma":[0.8193588,0.0035712926,0.002965835,0.0076588155,0.0541333,0.024613373,0.020822322,0.041594718,0.005766178],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019170908,0.0005744861,0.0012846906,0.009764017,0.00033254098,0.0015212776,0.15735513,0.002115543,0.0017729735,0.6109178,0.116650425,0.09579393],"study_design_scores_gemma":[0.0015884223,0.0013601652,0.0023231036,0.06988363,0.00027850494,0.0012680619,0.05216168,0.010543162,0.005325935,0.46393073,0.39050007,0.0008364816],"about_ca_topic_score_codex":0.0031856634,"about_ca_topic_score_gemma":0.003371685,"teacher_disagreement_score":0.98160565,"about_ca_system_score_codex":0.017728284,"about_ca_system_score_gemma":0.08505466,"threshold_uncertainty_score":0.2449013},"labels":[],"label_agreement":null}]}