{"id":"W2154726829","doi":"10.15398/jlm.v2i1.78","title":"Evaluation of automatic updates of Roget’s Thesaurus","year":2014,"lang":"en","type":"article","venue":"Journal of Language Modelling","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Thesaurus; Computer science; Information retrieval; Natural language processing; WordNet; Vocabulary; Artificial intelligence; Word (group theory); Linguistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01696085,0.001921167,0.002031799,0.006263999,0.001830327,0.002919605,0.004778156,0.00300253,0.002803179],"category_scores_gemma":[0.07927291,0.001210724,0.001306331,0.003503442,0.001567498,0.006720194,0.004292651,0.002128444,0.001714544],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002223328,"about_ca_system_score_gemma":0.002102772,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01302946,"about_ca_topic_score_gemma":0.01579551,"domain_scores_codex":[0.9811257,0.00801796,0.002326293,0.003592408,0.004434487,0.000503111],"domain_scores_gemma":[0.9442768,0.03567668,0.002495899,0.006581466,0.009808834,0.001160376],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004110975,0.002896496,0.03137948,0.003082132,0.001464188,0.0009192064,0.005016584,0.05509687,0.04130957,0.002483768,0.01589563,0.8363451],"study_design_scores_gemma":[0.001545121,0.006285837,0.1165017,0.0005635111,0.001150121,0.002739703,0.003294989,0.735555,0.08297993,0.002680538,0.04620272,0.0005008871],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9181035,0.002917973,0.05139967,0.0004191025,0.0005711035,0.001456024,0.002428393,0.01419245,0.008511791],"genre_scores_gemma":[0.8127949,0.0006760663,0.1621217,0.00028936,0.0001438732,0.0008490384,0.01725515,0.001161369,0.004708541],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01696085,"threshold_uncertainty_score":0.08969867,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02970266816764226,"score_gpt":0.3008975775526793,"score_spread":0.271194909385037,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}