{"id":"W4389519420","doi":"10.18653/v1/2023.emnlp-main.142","title":"A Diachronic Analysis of Paradigm Shifts in NLP Research: When, How, and Why?","year":2023,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"National Research Council Canada","funders":"Deutsche Forschungsgemeinschaft","keywords":"Leverage (statistics); Computer science; Inference; Causal inference; Artificial intelligence; Field (mathematics); Data science; Natural language processing; Machine learning; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001075256,0.00005402718,0.0001727472,0.0009050558,0.00003375817,0.00008220261,0.0004414854,0.00003438338,0.00001759152],"category_scores_gemma":[0.0000702387,0.00004732458,0.00004071554,0.00274634,0.00004399846,0.0002309991,0.0003808375,0.0001112969,0.00000880903],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00003067576,"about_ca_system_score_gemma":0.0000470873,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006582154,"about_ca_topic_score_gemma":0.001751351,"domain_scores_codex":[0.9988261,0.0001168422,0.0001438334,0.0003152332,0.00032264,0.0002753801],"domain_scores_gemma":[0.9991533,0.0002426446,0.00002315502,0.000495679,0.00002915582,0.00005602238],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000008647893,0.0001161223,0.06811345,0.0001046275,0.00040886,0.00009988026,0.01791885,0.01043966,0.0009989759,0.8105054,0.006140927,0.08514456],"study_design_scores_gemma":[0.0001199526,0.00002211741,0.04441891,0.00001006264,0.00001000149,1.983987e-7,0.00009680785,0.9360434,0.00007140981,0.01857708,0.0005661154,0.00006388798],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7229335,0.0002580727,0.2648779,0.01032619,0.00005238392,0.0001300262,0.000001228497,0.0001070643,0.001313566],"genre_scores_gemma":[0.994868,0.00005293118,0.004659313,0.00006409056,0.000010519,0.000008531355,0.000001014856,0.000002876458,0.0003327044],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9256038,"threshold_uncertainty_score":0.192984,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1503477852821135,"score_gpt":0.3498817030182792,"score_spread":0.1995339177361657,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}