{"id":"W4401420887","doi":"10.1075/lv.23057.ueg","title":"Cross-linguistic dataset of force-flavor combinations in modal elements","year":2024,"lang":"en","type":"article","venue":"Linguistic Variation","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"UK Research and Innovation","keywords":"Modal verb; Modal; Lexicalization; Modality (human–computer interaction); Linguistics; Typology; Computer science; Semantics (computer science); Natural language processing; Artificial intelligence; Geography; Philosophy; Archaeology; Verb","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002124224,0.0005384348,0.0004394148,0.005201341,0.001857865,0.002044491,0.001229893,0.001539237,0.01225823],"category_scores_gemma":[0.0128432,0.0002895923,0.0005365313,0.005665428,0.001477733,0.002135444,0.003903626,0.001669576,0.006117479],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001028106,"about_ca_system_score_gemma":0.001042984,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005620156,"about_ca_topic_score_gemma":0.01217171,"domain_scores_codex":[0.9971148,0.0009500792,0.0003636943,0.0006455999,0.0007417753,0.0001841498],"domain_scores_gemma":[0.9889364,0.005666642,0.0009100421,0.002214007,0.001751262,0.0005217733],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.002187998,0.001150504,0.1044505,0.00594968,0.0003256545,0.004334325,0.02733922,0.003566982,0.04183096,0.04905576,0.5224115,0.237397],"study_design_scores_gemma":[0.0001566774,0.000161638,0.1697468,0.0006574191,0.00006142584,0.002073203,0.01294214,0.002912228,0.008255534,0.01289734,0.7899213,0.000214366],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.4191141,0.001535379,0.0141416,0.001321805,0.0003973376,0.000580385,0.5111947,0.001512687,0.05020192],"genre_scores_gemma":[0.3294096,0.0003798674,0.02368115,0.0007343389,0.0001269485,0.001806677,0.6343911,0.0006123813,0.008857877],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.01225823,"threshold_uncertainty_score":0.04100788,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02923973186971261,"score_gpt":0.2993828384759613,"score_spread":0.2701431066062487,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}