{"id":"W2050369426","doi":"10.3115/1118735.1118737","title":"Induction of classification from lexicon expansion","year":2002,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"Academia Sinica; National Science Council","keywords":"WordNet; Computer science; Natural language processing; Lexicon; Artificial intelligence; Categorization; Information retrieval; Taxonomy (biology); Semantic similarity; Hierarchy; Lexical database","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00160451,0.001241355,0.00109309,0.004117124,0.00135182,0.002231686,0.001945732,0.00119844,0.008821956],"category_scores_gemma":[0.01097576,0.0006283674,0.00129116,0.002568816,0.001139465,0.004453531,0.003792814,0.002082667,0.007532144],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001335312,"about_ca_system_score_gemma":0.001917078,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001714879,"about_ca_topic_score_gemma":0.004050135,"domain_scores_codex":[0.9968321,0.0009784203,0.0002224287,0.0008703524,0.0007802455,0.0003165141],"domain_scores_gemma":[0.9940269,0.003171182,0.0002735158,0.001209831,0.00114336,0.000175252],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001813122,0.0003080768,0.00387466,0.0004626492,0.00005368874,0.0002908689,0.0003606314,0.009557262,0.01345055,0.04055034,0.02649674,0.9044132],"study_design_scores_gemma":[0.0001415386,0.0002785598,0.004938749,0.0002908319,0.0001678159,0.0007917591,0.0006049908,0.656363,0.03674278,0.2141934,0.08539422,0.00009235557],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04060521,0.0006923032,0.9264418,0.0009288788,0.0004007126,0.0008380753,0.001266642,0.008341415,0.02048505],"genre_scores_gemma":[0.3104982,0.0008398406,0.6513108,0.000739556,0.0004997076,0.001508966,0.01504471,0.00110202,0.01845621],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008821956,"threshold_uncertainty_score":0.02951241,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04685674669557996,"score_gpt":0.2699579955299167,"score_spread":0.2231012488343368,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}