{"id":"W2949495307","doi":"10.48550/arxiv.1411.0129","title":"The Latent Structure of Dictionaries","year":2014,"lang":"en","type":"preprint","venue":"Archipelago (Université du Québec à Montréal)","topic":"Lexicography and Language Studies","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Rest (music); Computer science; Word (group theory); Lexicon; Core (optical fiber); Set (abstract data type); Vertex (graph theory); Categorization; Natural language processing; Artificial intelligence; Graph; Mathematics; Theoretical computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.00008863305,0.0002924814,0.0003477964,0.0001357044,0.00148917,0.0001039194,0.0005543762,0.00009283015,0.000356503],"category_scores_gemma":[0.00003628925,0.0002001763,0.0003698595,0.00003668439,0.001190228,0.00007695634,0.0007582149,0.0004928213,0.00001034621],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005738635,"about_ca_system_score_gemma":0.0001414967,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.216221,"about_ca_topic_score_gemma":0.768239,"domain_scores_codex":[0.9988234,0.0001000111,0.0002457698,0.0002980285,0.0002757756,0.0002569922],"domain_scores_gemma":[0.9986359,0.0003060987,0.0003083652,0.0005097142,0.0001775188,0.00006235341],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001325774,0.00004717786,0.0006533604,0.0001364428,0.0008435352,0.00001640566,0.77661,0.0002729034,0.00001753999,0.2032924,0.006816406,0.01116125],"study_design_scores_gemma":[0.0008493303,0.0002218778,0.01152334,0.000242615,0.00061785,0.000009896902,0.1996624,0.0006358516,0.00004202496,0.04914164,0.7362543,0.0007988479],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9729745,0.01415251,0.0001103776,0.003540721,0.001085651,0.0002987436,0.0003031726,0.0001269922,0.007407359],"genre_scores_gemma":[0.9974608,0.0008013712,0.00003412288,0.0001171774,0.0005299933,0.000004135554,0.00003829093,0.00002386166,0.000990276],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7294379,"threshold_uncertainty_score":0.9998108,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.007067618035774298,"score_gpt":0.1600764667045236,"score_spread":0.1530088486687493,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}