{"meta":{"query_hash":"a87db38be0a9","filters":{"venue":"Corpus Linguistics and Linguistic Theory"},"cohort_total":15,"direct_labels_cover":0,"predictions_cover":15,"exported":15,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/a87db38be0a9","api":"https://metacan.xera.ac/api/v1/cohort?venue=Corpus+Linguistics+and+Linguistic+Theory"},"results":[{"id":"W2068619837","doi":"10.1515/cllt-2014-0011","title":"A multivariate analysis of the Old English ACC+DAT double object alternation","year":2014,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Alternation (linguistics); Linguistics; Object (grammar); Variation (astronomy); Verb; Dative case; Semantics (computer science); Psychology; Computer science; Mathematics; Philosophy","score_opus":0.017902671986126415,"score_gpt":0.24031874023093547,"score_spread":0.22241606824480906,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2068619837","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9980294,0.000031423584,0.0012256007,0.000025060808,0.0000044550784,0.0000064480664,0.00019570283,0.00001553004,0.00046649657],"genre_scores_gemma":[0.99903464,0.000011211635,0.0004738072,0.0000041391017,0.0000032012206,0.00000709043,0.00016452641,0.000015359896,0.0002860621],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9987845,0.0005678947,0.00009376484,0.00027390308,0.00019596318,0.00008398728],"domain_scores_gemma":[0.98662657,0.009960731,0.0015146864,0.0007599203,0.00077623053,0.00036191],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018635403,0.00021143269,0.00030009745,0.00068573246,0.00043549878,0.000776798,0.00025168085,0.00023685783,0.004649846],"category_scores_gemma":[0.011516023,0.00013257995,0.00037601168,0.0009922292,0.0005836806,0.00054062397,0.00055680115,0.0005283167,0.00033105668],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019061285,0.0002638721,0.924277,0.00010640867,0.0002901677,0.00093102467,0.0060059386,0.0006330508,0.02203344,0.0016733394,0.0010449619,0.040834576],"study_design_scores_gemma":[0.000009552995,0.00015162578,0.98980135,0.000012423622,0.000089296154,0.000330407,0.0013438239,0.0046790065,0.0018907809,0.00058557244,0.0010791705,0.000026959971],"about_ca_topic_score_codex":0.0040498464,"about_ca_topic_score_gemma":0.0035085964,"teacher_disagreement_score":0.004649846,"about_ca_system_score_codex":0.000247769,"about_ca_system_score_gemma":0.00021550513,"threshold_uncertainty_score":0.015555263},"labels":[],"label_agreement":null},{"id":"W2315347275","doi":"10.1515/cllt-2014-0020","title":"The meaning of intonation in yes-no questions in American English: A corpus study","year":2014,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Language, Discourse, Communication Strategies","field":"Arts and Humanities","cited_by":58,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Intonation (linguistics); Linguistics; Pitch accent; Utterance; Meaning (existential); Interrogative; Context (archaeology); Sentence; Pitch contour; American English; Stress (linguistics); Phrase; Word order; Psychology; Prosody; History; Philosophy","score_opus":0.017252652359156854,"score_gpt":0.2736270630687182,"score_spread":0.25637441070956135,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2315347275","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9954567,0.0002037925,0.0013899012,0.00011992128,0.0000111405425,0.000051079234,0.0003096711,0.0000134443535,0.0024442917],"genre_scores_gemma":[0.99625325,0.000153905,0.0020929014,0.000054753567,0.000013757151,0.00007606072,0.0005707368,0.000020534388,0.0007641076],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9983877,0.00097111316,0.00013570418,0.00024956246,0.00018448867,0.00007151953],"domain_scores_gemma":[0.9844066,0.011579938,0.001052835,0.0008709501,0.0018316123,0.00025806567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017733655,0.0002108734,0.00024234001,0.001187876,0.001520473,0.00095858215,0.00034488543,0.00048725924,0.0014629742],"category_scores_gemma":[0.008448016,0.00021408811,0.00013916897,0.0016183323,0.0018904479,0.0010822605,0.0011086969,0.0006137006,0.00017743983],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012949895,0.0010449208,0.25071996,0.001917378,0.00009459498,0.0031804391,0.4903744,0.0010447614,0.12412376,0.009226019,0.004956418,0.1120223],"study_design_scores_gemma":[0.00007510514,0.00035345805,0.78717935,0.0002614389,0.000093729795,0.0031035051,0.1239475,0.004303948,0.024201022,0.0018307589,0.054524355,0.00012595412],"about_ca_topic_score_codex":0.0074231005,"about_ca_topic_score_gemma":0.020335559,"teacher_disagreement_score":0.0074231005,"about_ca_system_score_codex":0.00055520365,"about_ca_system_score_gemma":0.00048502377,"threshold_uncertainty_score":0.014759779},"labels":[],"label_agreement":null},{"id":"W2327588828","doi":"10.1515/cllt.2011.008","title":"Safe harbour: Ethics and accessibility in sociolinguistic corpus building","year":2011,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Globe; Corpus linguistics; Linguistics; Computer science; Applied linguistics; Computational linguistics; Sociology; Data sharing; Natural language processing; Psychology; Philosophy","score_opus":0.03852763765365219,"score_gpt":0.3088898463052056,"score_spread":0.2703622086515534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2327588828","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02922508,0.0005501023,0.923438,0.010538179,0.00023684009,0.00085865665,0.00020205622,0.00028429923,0.03466664],"genre_scores_gemma":[0.46122473,0.00057052524,0.5246264,0.001000196,0.00021693061,0.0029691278,0.00043591566,0.0005265759,0.008429626],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88154125,0.10628412,0.0030115442,0.0032406093,0.0050189937,0.0009035373],"domain_scores_gemma":[0.8403632,0.11643987,0.0046057496,0.028344356,0.008282952,0.001963956],"candidate_categories":["metaresearch","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.0769566,0.0004990534,0.00063069287,0.0039945464,0.009099717,0.01130363,0.0025070044,0.0032554946,0.004696524],"category_scores_gemma":[0.14378342,0.0011785951,0.000492123,0.0038503455,0.028363353,0.020114088,0.01597708,0.004823613,0.0010699125],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006835554,0.00006499829,0.0018823007,0.00022157675,0.000015054922,0.00045229314,0.0890399,0.0020701191,0.0011969031,0.8446196,0.003942955,0.056425977],"study_design_scores_gemma":[0.00003393067,0.000054172888,0.0011876147,0.0006198585,0.000017936463,0.00056967436,0.030739145,0.011547205,0.003523467,0.8011368,0.15050516,0.000065071225],"about_ca_topic_score_codex":0.0034418032,"about_ca_topic_score_gemma":0.0049466738,"teacher_disagreement_score":0.9967445,"about_ca_system_score_codex":0.0034694406,"about_ca_system_score_gemma":0.008102502,"threshold_uncertainty_score":0.4069903},"labels":[],"label_agreement":null},{"id":"W2332964166","doi":"10.1515/cllt-2013-0014","title":"Topic marking in a Shanghainese corpus: from observation to prediction","year":2013,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Linguistic Variation and Morphology","field":"Social Sciences","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Polytomous Rasch model; Computer science; Natural language processing; Logistic regression; Artificial intelligence; Multivariate statistics; Selection (genetic algorithm); Computational linguistics; Machine learning; Statistics; Item response theory; Mathematics; Psychometrics","score_opus":0.022892869246276686,"score_gpt":0.2744754931635357,"score_spread":0.251582623917259,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2332964166","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97692454,0.00070234656,0.01394005,0.0003738598,0.0000487387,0.00003846947,0.0044581066,0.00026322377,0.0032506],"genre_scores_gemma":[0.98773336,0.00018101509,0.006000651,0.000025116302,0.000030215133,0.00005087616,0.0050735944,0.00008393982,0.00082114426],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989229,0.00054579414,0.00006944052,0.00028946163,0.00011522249,0.000057149693],"domain_scores_gemma":[0.9782601,0.017652757,0.0011340468,0.0014367967,0.0012721863,0.00024419895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029811335,0.00031606754,0.00040775072,0.0017570783,0.0005792803,0.0015437109,0.00035488082,0.00036492685,0.0020694989],"category_scores_gemma":[0.016576987,0.00033002812,0.00025891274,0.0030867558,0.00079932227,0.001272693,0.0011524579,0.00083498325,0.00071040186],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011156575,0.00019358215,0.7189896,0.0009259523,0.0002925265,0.0013063786,0.026145559,0.012611291,0.021750975,0.010176267,0.016498731,0.18999343],"study_design_scores_gemma":[0.00006530641,0.00010637656,0.8568745,0.00017137559,0.00013375924,0.00047768146,0.00676098,0.09567187,0.006215207,0.0073154992,0.02607469,0.00013281824],"about_ca_topic_score_codex":0.012666196,"about_ca_topic_score_gemma":0.018670604,"teacher_disagreement_score":0.012666196,"about_ca_system_score_codex":0.00061434077,"about_ca_system_score_gemma":0.00046213108,"threshold_uncertainty_score":0.02518493},"labels":[],"label_agreement":null},{"id":"W2563400189","doi":"10.1515/cllt-2015-0047","title":"Mass counts in World Englishes: A corpus linguistic study of noun countability in non-native varieties of English","year":2016,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Linguistic Variation and Morphology","field":"Social Sciences","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"York St John University","keywords":"Linguistics; Noun; Syntax; Nominalization; World Englishes; Corpus linguistics; Applied linguistics; Varieties of English; Natural language processing; Computer science; Philosophy","score_opus":0.016003089102713267,"score_gpt":0.2859726892322059,"score_spread":0.26996960012949267,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2563400189","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9983877,0.000052553056,0.0001420098,0.000025133459,0.0000017947509,0.0000055201617,0.000119864664,0.0000021138783,0.0012633963],"genre_scores_gemma":[0.9992446,0.00003810694,0.00021562878,0.000011254038,0.0000023048412,0.000011933691,0.00021133416,0.000009069544,0.00025584144],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.9990428,0.0004556077,0.00009639417,0.00019731924,0.00014370224,0.00006413305],"domain_scores_gemma":[0.9877145,0.008759156,0.0013700004,0.000774856,0.0011010583,0.00028044562],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014131113,0.00023176597,0.00039089497,0.002622986,0.0021004474,0.002174601,0.00050728035,0.0003292597,0.0023624012],"category_scores_gemma":[0.008236175,0.00026663416,0.00014950216,0.0029874071,0.0022158267,0.0023701321,0.0018249915,0.00078987237,0.00018817079],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00072115014,0.0004848881,0.39979583,0.00043285498,0.00015580223,0.0017206925,0.5309,0.00032222088,0.024739573,0.012937258,0.0013838387,0.0264059],"study_design_scores_gemma":[0.00002225435,0.00008713986,0.84529614,0.00005858065,0.00006258129,0.0010604536,0.14224969,0.0008933943,0.0026620433,0.0014762738,0.006080437,0.00005105433],"about_ca_topic_score_codex":0.016389206,"about_ca_topic_score_gemma":0.038099088,"teacher_disagreement_score":0.016389206,"about_ca_system_score_codex":0.00081926625,"about_ca_system_score_gemma":0.00041348042,"threshold_uncertainty_score":0.032587588},"labels":[],"label_agreement":null},{"id":"W2756059139","doi":"10.1515/cllt-2016-0052","title":"Common ground across globalized English varieties: A multivariate exploration of mental predicates in World Englishes","year":2017,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Linguistic Variation and Morphology","field":"Social Sciences","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"World Englishes; Irish; Focus (optics); Linguistics; Common ground; Varieties of English; Multivariate statistics; American English; Sociology; Computer science; Philosophy","score_opus":0.036931674976311626,"score_gpt":0.34753770573814985,"score_spread":0.31060603076183824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2756059139","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9983754,0.000013599887,0.001003619,0.00003067677,7.799765e-7,0.000005551982,0.000058393874,0.000005186548,0.00050680264],"genre_scores_gemma":[0.9993949,0.000007903191,0.00040446527,0.0000039875604,7.705648e-7,0.0000067744195,0.00007730239,0.0000065367335,0.00009733154],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9981635,0.0009388362,0.00007895428,0.0003663382,0.0002684913,0.00018387382],"domain_scores_gemma":[0.992353,0.004845446,0.0012690116,0.0007641746,0.00041508224,0.0003533209],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024206857,0.0003292045,0.00042913423,0.0019128687,0.0008693682,0.0031065189,0.0004939663,0.00030323493,0.0029151845],"category_scores_gemma":[0.010483619,0.00024289358,0.00076959503,0.0017112496,0.002113497,0.0030115214,0.0033591844,0.0009200466,0.00014606313],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032927346,0.00018062461,0.8503073,0.000060873524,0.0002680666,0.000408156,0.11175498,0.001325826,0.005829531,0.007228199,0.00023068707,0.0220764],"study_design_scores_gemma":[0.000008991784,0.0001519142,0.89493245,0.000026620926,0.00007964446,0.00020419492,0.08659803,0.009046356,0.0011462597,0.006198622,0.0015621068,0.000044825094],"about_ca_topic_score_codex":0.013762835,"about_ca_topic_score_gemma":0.010669344,"teacher_disagreement_score":0.013762835,"about_ca_system_score_codex":0.0008732025,"about_ca_system_score_gemma":0.00048543914,"threshold_uncertainty_score":0.027365446},"labels":[],"label_agreement":null},{"id":"W2803450908","doi":"10.1515/cllt-2016-0078","title":"Unifying dimensions in coherence relations: How various annotation frameworks are related","year":2018,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":71,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Universiteit Utrecht; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; Deutsche Forschungsgemeinschaft","keywords":"Treebank; Computer science; Annotation; Coherence (philosophical gambling strategy); Dimension (graph theory); Set (abstract data type); Representation (politics); Rhetorical question; Natural language processing; Artificial intelligence; Interface (matter); Linguistics; Programming language; Mathematics","score_opus":0.010668414240520572,"score_gpt":0.2592416203831324,"score_spread":0.24857320614261186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2803450908","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10954026,0.0011838954,0.8587389,0.0037275434,0.00019466033,0.0002467319,0.00067681697,0.001634307,0.024056865],"genre_scores_gemma":[0.68292624,0.00047751094,0.31292242,0.00029152117,0.000056772387,0.00044008225,0.0007274777,0.00062150037,0.0015364907],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96221215,0.025893295,0.0022718112,0.003941842,0.0047689537,0.0009119145],"domain_scores_gemma":[0.8836663,0.08192499,0.006693074,0.015607001,0.010945959,0.001162666],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035313495,0.00074832456,0.0008822095,0.010172279,0.0034974925,0.010866551,0.0018892824,0.0015991734,0.003390228],"category_scores_gemma":[0.13137606,0.001046805,0.00079426856,0.007739642,0.008524878,0.024497647,0.010828726,0.003397983,0.0006181897],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003875284,0.00008431241,0.0123370625,0.0006216745,0.00008803532,0.00015281513,0.052502804,0.0029234579,0.008466743,0.66977847,0.0033687034,0.2492885],"study_design_scores_gemma":[0.00007565854,0.00012675715,0.014433395,0.001081267,0.00017769155,0.00033105342,0.03414431,0.050652973,0.014418962,0.7954169,0.088849775,0.0002913687],"about_ca_topic_score_codex":0.0068371138,"about_ca_topic_score_gemma":0.006671171,"teacher_disagreement_score":0.035313495,"about_ca_system_score_codex":0.0034284343,"about_ca_system_score_gemma":0.0032387988,"threshold_uncertainty_score":0.18675786},"labels":[],"label_agreement":null},{"id":"W2807690984","doi":"10.1515/cllt-2017-0031","title":"Dependency profiles in the large-scale analysis of discourse connectives","year":2018,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Brock University","funders":"Turun Yliopisto","keywords":"Dependency (UML); Computer science; Syntax; Natural language processing; Scope (computer science); Artificial intelligence; Linguistics; Cluster analysis; Focus (optics); Annotation","score_opus":0.00909766402107549,"score_gpt":0.2919299757573142,"score_spread":0.28283231173623874,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2807690984","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.89311427,0.00038403185,0.10123186,0.00011618293,0.000016337975,0.00013479937,0.0019174218,0.0002895597,0.0027956609],"genre_scores_gemma":[0.96506184,0.000084273604,0.03331181,0.000011103422,0.000008862354,0.00012855805,0.001068583,0.000046615736,0.00027828212],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99712247,0.0015990529,0.0001958342,0.0005567312,0.00042180068,0.0001040025],"domain_scores_gemma":[0.98065954,0.015795518,0.0012671694,0.0009758236,0.0010086865,0.00029337956],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027526973,0.0003076451,0.00038880706,0.0054364693,0.0011186486,0.0014600549,0.0005216671,0.00045809735,0.0016902561],"category_scores_gemma":[0.02017612,0.000311382,0.0003720756,0.005369746,0.00085651217,0.0023439082,0.0015862739,0.0007139984,0.00039151873],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019589346,0.00062845566,0.34148824,0.0016046172,0.00053827325,0.0025898556,0.02976373,0.036597136,0.07716006,0.059785917,0.0053761634,0.4425086],"study_design_scores_gemma":[0.000066432825,0.00028543817,0.44575045,0.00028565087,0.000279409,0.0018609713,0.013373015,0.40163377,0.04212883,0.071230754,0.02290628,0.00019888922],"about_ca_topic_score_codex":0.0026166358,"about_ca_topic_score_gemma":0.0029773503,"teacher_disagreement_score":0.0054364693,"about_ca_system_score_codex":0.00069492875,"about_ca_system_score_gemma":0.0006118932,"threshold_uncertainty_score":0.014557779},"labels":[],"label_agreement":null},{"id":"W2898954967","doi":"10.1515/cllt-2018-0033","title":"An information-theoretic view on language complexity and register variation: Compressing naturalistic corpus data","year":2018,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Variation (astronomy); Register (sociolinguistics); Linguistics; Formality; Context (archaeology); Conversation; Sentence; Natural language processing; Artificial intelligence","score_opus":0.030986459640575396,"score_gpt":0.31101361548343714,"score_spread":0.28002715584286175,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2898954967","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.52276623,0.00083631976,0.46586278,0.0017027998,0.00006656212,0.00013543585,0.0023377207,0.00031443837,0.00597774],"genre_scores_gemma":[0.9300447,0.00028098043,0.06617871,0.00011028059,0.000102883336,0.00020949445,0.0022455975,0.000091502836,0.00073588546],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99485743,0.0025011997,0.0004999235,0.00070893375,0.0011968627,0.00023569129],"domain_scores_gemma":[0.93919164,0.046296556,0.0040483326,0.0069313087,0.002918628,0.0006135644],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0062937005,0.00044196035,0.0008239108,0.0073994272,0.0010224422,0.004275642,0.001121405,0.00076094904,0.0020327652],"category_scores_gemma":[0.06627839,0.00039685465,0.0006943898,0.0066708843,0.0046994584,0.0063383807,0.0029210101,0.0015518802,0.00025482487],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014370024,0.0002432365,0.08093922,0.00083637715,0.00044628055,0.0007308841,0.008534563,0.14817846,0.0155187445,0.38819987,0.0041202763,0.35081506],"study_design_scores_gemma":[0.000055237644,0.0003093527,0.07125997,0.00021410424,0.000113471375,0.0007067573,0.0033803245,0.43906128,0.0067387405,0.4703301,0.0076021664,0.00022860568],"about_ca_topic_score_codex":0.004119723,"about_ca_topic_score_gemma":0.0032378032,"teacher_disagreement_score":0.0073994272,"about_ca_system_score_codex":0.0020709608,"about_ca_system_score_gemma":0.0009964107,"threshold_uncertainty_score":0.033284664},"labels":[],"label_agreement":null},{"id":"W3161046106","doi":"10.1515/cllt-2020-0028","title":"Switch-reference and its role in referential choice in Mbyá Guaraní narratives","year":2021,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; Connaught Fund","keywords":"Ambiguity; Self-reference; Reference model; Computer science; Function (biology); Narrative; Linguistics; Philosophy","score_opus":0.027123376247697555,"score_gpt":0.2525062085082269,"score_spread":0.22538283226052935,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3161046106","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98945695,0.00092785293,0.0019486543,0.00070583826,0.0000071959143,0.000012102762,0.000063713276,0.000012994304,0.0068646786],"genre_scores_gemma":[0.99928623,0.000114673094,0.00037327383,0.000013485512,0.000001736796,0.0000038660673,0.00002029346,0.000004465716,0.00018185348],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.99621564,0.0025976484,0.00021901997,0.00038221377,0.00033091253,0.00025461387],"domain_scores_gemma":[0.98373955,0.01229094,0.002588803,0.00058360526,0.0004893431,0.00030774402],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056315335,0.00040155108,0.00057286315,0.0029360224,0.002565844,0.0037300754,0.00093452976,0.0009003287,0.0026416364],"category_scores_gemma":[0.02410982,0.00037052485,0.0001650198,0.0039399257,0.004731732,0.0045684874,0.0041419733,0.0010111777,0.00013363647],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046135357,0.00008613242,0.16026615,0.00045919872,0.00007461337,0.0027952197,0.6920262,0.0008838702,0.0033990466,0.102830335,0.00056191505,0.036156036],"study_design_scores_gemma":[0.000064217995,0.00017915579,0.29195163,0.0010606525,0.00020573534,0.0024512452,0.56201786,0.009577327,0.006238407,0.08965476,0.036383845,0.00021513154],"about_ca_topic_score_codex":0.019031744,"about_ca_topic_score_gemma":0.017112862,"teacher_disagreement_score":0.019031744,"about_ca_system_score_codex":0.003522874,"about_ca_system_score_gemma":0.0012384964,"threshold_uncertainty_score":0.037841916},"labels":[],"label_agreement":null},{"id":"W4241042034","doi":"10.1515/cllt-2012-masthead1","title":"Masthead","year":2012,"lang":"en","type":"paratext","venue":"Corpus Linguistics and Linguistic Theory","topic":"Marriage and Sexual Relationships","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science","score_opus":0.04361840048096364,"score_gpt":0.33183670909712976,"score_spread":0.2882183086161661,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4241042034","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00044493566,0.00061461114,0.0032593193,0.0010189886,0.0006999173,0.000048062768,0.007821128,0.004540292,0.9815528],"genre_scores_gemma":[0.0014794122,0.00021775483,0.0009075641,0.00018388595,0.00011188563,0.000030026718,0.002903045,0.001509636,0.99265677],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99949074,0.00007375413,0.000029503437,0.00013679224,0.0002144525,0.000054687553],"domain_scores_gemma":[0.9987374,0.00027952314,0.00005012119,0.00031256455,0.00043921437,0.00018120909],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0007404414,0.00092119083,0.0010487525,0.0027782815,0.0020556953,0.0051190667,0.0015040546,0.0015774883,0.87203926],"category_scores_gemma":[0.0035878941,0.00060693675,0.0005344139,0.0034375123,0.0005903491,0.0043713693,0.002685637,0.0016744855,0.7843354],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004272669,0.000014783293,0.00007680484,0.00010889686,0.0000018449931,0.00003858846,0.00011399686,0.00005486179,0.00025162045,0.007284439,0.88070476,0.1113066],"study_design_scores_gemma":[0.0000055152273,0.000005059571,0.00023624189,0.000046498735,0.0000018138668,0.000038925693,0.00006605168,0.000073270574,0.00016516722,0.0026175468,0.9967393,0.0000045486026],"about_ca_topic_score_codex":0.0031071643,"about_ca_topic_score_gemma":0.00857817,"teacher_disagreement_score":0.12796074,"about_ca_system_score_codex":0.00071975077,"about_ca_system_score_gemma":0.0010459059,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4388046533","doi":"10.1515/cllt-2021-0058","title":"Truth be told: a corpus-based study of the cross-linguistic colexification of representational and (inter)subjective meanings","year":2023,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Language, Metaphor, and Cognition","field":"Psychology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; University of Toronto","funders":"Jackman Humanities Institute, University of Toronto; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Linguistics; Focus (optics); Meaning (existential); Corpus linguistics; Variation (astronomy); Computer science; Epistemology; Philosophy","score_opus":0.03143056356154125,"score_gpt":0.3366006567825191,"score_spread":0.3051700932209779,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388046533","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96994543,0.00052948855,0.009768025,0.0005167861,0.000064066924,0.00020203638,0.0011529621,0.000042581098,0.01777857],"genre_scores_gemma":[0.9910426,0.000212517,0.0061646444,0.0000961101,0.000024763516,0.00031589056,0.00085728447,0.00008028584,0.0012057438],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.9951178,0.00336018,0.00030097444,0.000602965,0.0004950503,0.00012303893],"domain_scores_gemma":[0.9530118,0.037989173,0.0023164998,0.0034885926,0.0027550573,0.00043884336],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007444591,0.00024769225,0.00048396672,0.004796671,0.004131264,0.0035926995,0.00085313595,0.00076319417,0.0037488616],"category_scores_gemma":[0.033444833,0.00044648367,0.00020325732,0.007602174,0.005957219,0.0041809296,0.0043006763,0.0019439934,0.00034349837],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042527603,0.00042980094,0.03763762,0.00124405,0.000081927166,0.0016921225,0.8193273,0.0007764291,0.012205075,0.067454785,0.005517207,0.05320842],"study_design_scores_gemma":[0.00014639681,0.0002977948,0.25274652,0.0011145729,0.00014244393,0.0028963925,0.58522916,0.009574,0.012968743,0.027209913,0.10743056,0.00024342489],"about_ca_topic_score_codex":0.007644879,"about_ca_topic_score_gemma":0.015858512,"teacher_disagreement_score":0.007644879,"about_ca_system_score_codex":0.0018646474,"about_ca_system_score_gemma":0.0011395415,"threshold_uncertainty_score":0.039371252},"labels":[],"label_agreement":null},{"id":"W4394842830","doi":"10.1515/cllt-2023-0028","title":"The distributional properties of long nominal compounds in scientific articles: an investigation based on the uniform information density hypothesis","year":2024,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Advanced Text Analysis Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Computer science; Constant (computer programming); Scientific literature; Information transmission; Econometrics; Data science; Information retrieval; Mathematics; Biology","score_opus":0.021486894088511916,"score_gpt":0.23154092932942288,"score_spread":0.21005403524091096,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394842830","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9656883,0.00090488466,0.020291746,0.0013120057,0.000051159415,0.000072268915,0.00043381413,0.00008207357,0.011163758],"genre_scores_gemma":[0.99647266,0.00013959428,0.0028284632,0.000044250977,0.00005091493,0.000039151324,0.00013343981,0.000025128109,0.00026636614],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9936094,0.0031281826,0.0007673131,0.0007982272,0.0014927362,0.0002040808],"domain_scores_gemma":[0.8100759,0.15244135,0.020273605,0.0055140518,0.010134092,0.001560998],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0079396125,0.00015461764,0.0004925621,0.0055032787,0.001959468,0.0037842188,0.0007074168,0.0010038716,0.0033614328],"category_scores_gemma":[0.0797412,0.00034747034,0.0002643646,0.005582053,0.0044397046,0.006436333,0.0019623628,0.0010866666,0.000447745],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0034019863,0.0005078787,0.40524542,0.0025670188,0.00053180783,0.003916723,0.11360978,0.003915786,0.06887725,0.24953717,0.0047495672,0.14313965],"study_design_scores_gemma":[0.00019521077,0.00089178694,0.64428234,0.00067376334,0.00039117478,0.0044859573,0.08067863,0.041760683,0.024717968,0.17130892,0.030203287,0.0004103051],"about_ca_topic_score_codex":0.0011975225,"about_ca_topic_score_gemma":0.0011318636,"teacher_disagreement_score":0.9944967,"about_ca_system_score_codex":0.0013323944,"about_ca_system_score_gemma":0.00067019305,"threshold_uncertainty_score":0.041989148},"labels":[],"label_agreement":null},{"id":"W4394855929","doi":"10.1515/cllt-2023-0104","title":"Corpus-based discourse analysis: from meta-reflection to accountability","year":2024,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Discourse Analysis in Language Studies","field":"Arts and Humanities","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Australian Research Data Commons; Simon Fraser University; University of Sydney","keywords":"Accountability; Transparency (behavior); Objectivity (philosophy); Reflexivity; Computer science; Corpus linguistics; Consistency (knowledge bases); Subjectivity; Analytics; Data science; Reflection (computer programming); Discourse analysis; Phenomenon; Epistemology; Linguistics; Sociology; Natural language processing; Political science; Artificial intelligence; Social science; Programming language; Philosophy","score_opus":0.04261411326796034,"score_gpt":0.3263412858121069,"score_spread":0.2837271725441466,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394855929","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06458036,0.004693317,0.8018883,0.05717623,0.0013286431,0.0015785958,0.00078602013,0.0012123731,0.066756114],"genre_scores_gemma":[0.6886786,0.0024846322,0.29626396,0.0019678501,0.00049933564,0.0023525124,0.0005796658,0.0011116939,0.006061756],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","domain_scores_codex":[0.75702775,0.21111433,0.006128638,0.0075544245,0.016609218,0.0015656499],"domain_scores_gemma":[0.4653349,0.4480742,0.012946406,0.04781499,0.02343908,0.0023904673],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.19647373,0.001211089,0.001508267,0.013052848,0.007986264,0.026929494,0.00476887,0.0032971075,0.0051133265],"category_scores_gemma":[0.2886644,0.0013815463,0.00076732965,0.011380154,0.041712273,0.035099994,0.020921329,0.007755559,0.0008541454],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008751999,0.00006456397,0.0019321943,0.0010562101,0.000090974194,0.0003078941,0.40406325,0.0018343927,0.0019571446,0.46317357,0.007190738,0.118241526],"study_design_scores_gemma":[0.00004582282,0.000071507464,0.0020684851,0.0042848275,0.00005859005,0.00024906304,0.14501652,0.0130805485,0.0046548243,0.6626827,0.1676261,0.00016100016],"about_ca_topic_score_codex":0.0044673258,"about_ca_topic_score_gemma":0.0038633323,"teacher_disagreement_score":0.19647373,"about_ca_system_score_codex":0.013666396,"about_ca_system_score_gemma":0.01636032,"threshold_uncertainty_score":0.9908909},"labels":[],"label_agreement":null},{"id":"W4405006658","doi":"10.1515/cllt-2024-0015","title":"A multivariate analysis of canonical and non-canonical uses of switch-reference markers in Mbyá narratives","year":2024,"lang":"en","type":"article","venue":"Corpus Linguistics and Linguistic Theory","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Canonical form; Computer science; Linguistics; Non canonical; Narrative; Epiphenomenon; Argument (complex analysis); Mathematics; Pure mathematics; Philosophy; Medicine","score_opus":0.024903084471919315,"score_gpt":0.27109074584601395,"score_spread":0.24618766137409465,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405006658","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9969831,0.00014484023,0.00071190234,0.00006781963,0.000003232434,0.000011743975,0.00040796984,0.000011952521,0.0016573083],"genre_scores_gemma":[0.9983272,0.00006903269,0.0005895137,0.0000071197505,0.00000341426,0.00002019585,0.00045687065,0.000020288086,0.00050636724],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99918455,0.0003618918,0.000059421098,0.0001819911,0.00009245229,0.00011971543],"domain_scores_gemma":[0.99215215,0.0051574125,0.0013677713,0.0005315215,0.00047985915,0.00031131666],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012062157,0.00018649534,0.00025076326,0.0016992901,0.0009392712,0.001679052,0.0002939,0.00027588394,0.0032585394],"category_scores_gemma":[0.012206874,0.00018871755,0.00021499718,0.0027957228,0.0010410274,0.0012889513,0.0017554322,0.00070592476,0.0002962583],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009969563,0.00014183944,0.77984524,0.0002748418,0.0002002358,0.00071015896,0.11171811,0.00055568037,0.014850269,0.012166479,0.0020240196,0.076516114],"study_design_scores_gemma":[0.0000058972455,0.000043272317,0.9624834,0.000045710167,0.000057267218,0.00029947158,0.027489549,0.002259196,0.0012175489,0.0012376185,0.004834067,0.000026939952],"about_ca_topic_score_codex":0.013900084,"about_ca_topic_score_gemma":0.017457258,"teacher_disagreement_score":0.013900084,"about_ca_system_score_codex":0.0007620993,"about_ca_system_score_gemma":0.0003873177,"threshold_uncertainty_score":0.027638316},"labels":[],"label_agreement":null}]}