{"id":"W2251942550","doi":"10.3115/v1/p15-1051","title":"Encoding Distributional Semantics into Triple-Based Knowledge Ranking for Document Enrichment","year":2015,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Semantics (computer science); Computer science; Computational linguistics; Zhàng; Ranking (information retrieval); Natural language processing; Encoding (memory); Volume (thermodynamics); Artificial intelligence; Linguistics; Association (psychology); Information retrieval; Library science; Programming language; History; China; Philosophy; Epistemology; Archaeology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007864523,0.0001207607,0.0001382508,0.00007131486,0.000127704,0.0001542803,0.000517979,0.00004350083,0.000008690015],"category_scores_gemma":[0.0001015914,0.0001065651,0.00007290692,0.0001679624,0.00001570501,0.0002401591,0.0001946839,0.00006152702,0.00002162573],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003078059,"about_ca_system_score_gemma":0.0002720491,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001966061,"about_ca_topic_score_gemma":0.00001008942,"domain_scores_codex":[0.9987977,0.00003648921,0.0002676831,0.0003353332,0.0002889662,0.0002738477],"domain_scores_gemma":[0.9991231,0.0001384828,0.00006077495,0.0003414346,0.0001947603,0.0001414621],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001990042,0.0001418114,0.0008836527,0.00006137609,0.00002524572,0.00000365413,0.001550819,0.004561822,0.0004708947,0.9604071,0.004864627,0.02700903],"study_design_scores_gemma":[0.001712036,0.00007919566,0.00003046947,0.00002873334,0.000008762579,0.000002503261,0.00005622802,0.9266289,0.005609504,0.0370993,0.02852785,0.0002164692],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.002643803,0.0001325733,0.9921125,0.002144795,0.0008703825,0.0002950741,0.000001538201,0.0001472532,0.001652037],"genre_scores_gemma":[0.7363375,8.714123e-7,0.2629801,0.0001515419,0.0001291926,0.00004603608,0.00001042961,0.000004334279,0.0003400025],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9233078,"threshold_uncertainty_score":0.4345597,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04827935784633595,"score_gpt":0.3117980470521634,"score_spread":0.2635186892058274,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}