{"meta":{"query_hash":"bcdf9eba7291","filters":{"venue":"Theoretical and Applied Linguistics"},"cohort_total":2,"direct_labels_cover":0,"predictions_cover":2,"exported":2,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/bcdf9eba7291","api":"https://metacan.xera.ac/api/v1/cohort?venue=Theoretical+and+Applied+Linguistics"},"results":[{"id":"W3179142225","doi":"10.22250/2410-7190_2021_7_2_160_168","title":"ENGLISH WORD STRESS IN LONG-TERM LANGUAGE CONTACT","year":2021,"lang":"en","type":"article","venue":"Theoretical and Applied Linguistics","topic":"Linguistics, Language Diversity, and Identity","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Linguistics; Language contact; Stress (linguistics); Variety (cybernetics); Syllable; Assimilation (phonology); Lexicon; Term (time); Varieties of English; History; Perspective (graphical); Psychology; Computer science; Artificial intelligence","score_opus":0.008880693194363251,"score_gpt":0.2225417419911253,"score_spread":0.21366104879676207,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3179142225","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9972378,0.00035882686,0.000061865,0.000033748063,0.0000040262366,0.0000021003118,0.000053008418,0.0000015307892,0.0022470977],"genre_scores_gemma":[0.99917704,0.00013529051,0.000025013056,0.000009707818,0.0000052477385,0.0000025444476,0.000056257537,0.0000021928363,0.0005867215],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9996953,0.00005559871,0.000024871944,0.00005181564,0.000104763145,0.00006764713],"domain_scores_gemma":[0.99842715,0.0005070841,0.0004538971,0.000050624072,0.0003395524,0.00022166835],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00032958572,0.00016080811,0.00018408798,0.00084920524,0.00076993357,0.0012958668,0.00020405462,0.00026727404,0.0031002213],"category_scores_gemma":[0.0019036072,0.00007663834,0.00011860155,0.0016472192,0.0008175973,0.00078589766,0.0009781744,0.00028593992,0.00031253506],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009898564,0.0001741252,0.8398413,0.0002524152,0.000053822157,0.0018369481,0.07975623,0.00015599091,0.022581492,0.0021587366,0.0005059461,0.051693074],"study_design_scores_gemma":[0.0000020585205,0.00006867486,0.9838188,0.000016986553,0.000009341878,0.00019887352,0.013896851,0.000037232658,0.00048425942,0.0002485988,0.001208884,0.000009333962],"about_ca_topic_score_codex":0.020040996,"about_ca_topic_score_gemma":0.02655007,"teacher_disagreement_score":0.020040996,"about_ca_system_score_codex":0.0010209638,"about_ca_system_score_gemma":0.0005858037,"threshold_uncertainty_score":0.039848685},"labels":[],"label_agreement":null},{"id":"W4414739115","doi":"10.22250/24107190-2025-11-3-87","title":"Corpus-based discourse analysis of connected speech phenomena in typologically diverse languages","year":2025,"lang":"en","type":"article","venue":"Theoretical and Applied Linguistics","topic":"Discourse Analysis and Cultural Communication","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Scripting language; Annotation; Python (programming language); Computational linguistics; Speech corpus; Corpus linguistics; Natural language; Text corpus","score_opus":0.012984859570633722,"score_gpt":0.339433345069315,"score_spread":0.3264484854986813,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414739115","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19481874,0.001289778,0.7713728,0.00036576274,0.0002042421,0.0026936275,0.01054613,0.0020645158,0.016644461],"genre_scores_gemma":[0.28740326,0.00045944288,0.6919478,0.000057925707,0.00006196276,0.0042404807,0.011986522,0.0004255957,0.0034169785],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99496365,0.0025381406,0.00044792445,0.0011915595,0.00074295973,0.00011578821],"domain_scores_gemma":[0.9903122,0.0063134828,0.0005035007,0.001147773,0.0015246833,0.00019833299],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0039580814,0.0006649788,0.00054688414,0.009439089,0.0018644842,0.002665513,0.0010421327,0.0006854267,0.004317331],"category_scores_gemma":[0.009181015,0.00035119127,0.00062166055,0.0058625224,0.001423952,0.0021077662,0.002501993,0.00091477926,0.0009520021],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00059139356,0.00067598035,0.02016732,0.003283543,0.0003282557,0.0019018296,0.066082954,0.009232857,0.14076665,0.091722295,0.010300699,0.65494627],"study_design_scores_gemma":[0.00019183327,0.00068615633,0.12162237,0.0016123131,0.00056816806,0.0035033575,0.07108557,0.19342299,0.16303958,0.09912545,0.34461847,0.00052379246],"about_ca_topic_score_codex":0.0029819643,"about_ca_topic_score_gemma":0.0038885488,"teacher_disagreement_score":0.009439089,"about_ca_system_score_codex":0.0012687516,"about_ca_system_score_gemma":0.002123036,"threshold_uncertainty_score":0.020932555},"labels":[],"label_agreement":null}]}