{"id":"W2079754016","doi":"10.3115/1613186.1613187","title":"Statistical measures of the semi-productivity of light verb constructions","year":2004,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":61,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Measure (data warehouse); Productivity; Verb; Natural language processing; Computer science; Artificial intelligence; Statistical analysis; Linguistics; Mathematics; Statistics; Data mining; Philosophy","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01361101,0.0006523948,0.0006766662,0.006146438,0.0007824998,0.002650022,0.001256647,0.001117151,0.002153107],"category_scores_gemma":[0.1301946,0.0005181153,0.0008027167,0.003340707,0.003598053,0.003489574,0.002551194,0.001585081,0.0006318908],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000540482,"about_ca_system_score_gemma":0.0005099922,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004761672,"about_ca_topic_score_gemma":0.0005300779,"domain_scores_codex":[0.98446,0.005560984,0.002477024,0.002214144,0.004832683,0.0004552322],"domain_scores_gemma":[0.5947693,0.3168658,0.04527463,0.02359427,0.01629763,0.003198354],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002173279,0.0005030987,0.5928774,0.001364378,0.0009149669,0.0009266249,0.006772845,0.03016241,0.08577474,0.03257851,0.001752957,0.2441987],"study_design_scores_gemma":[0.0001001704,0.00150305,0.6726785,0.0001441477,0.0002988722,0.003259223,0.00259427,0.1678163,0.04519249,0.09954751,0.006441155,0.0004243248],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7260802,0.0005405645,0.2645734,0.0001644656,0.00004022933,0.0001906775,0.001512404,0.0007609707,0.006137092],"genre_scores_gemma":[0.9720396,0.0001053305,0.02583975,0.00002885244,0.00005858736,0.0001981508,0.001299977,0.0001150358,0.0003145896],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01361101,"threshold_uncertainty_score":0.07198274,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.014977395325543,"score_gpt":0.2579192293006384,"score_spread":0.2429418339750954,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}