{"id":"W2182032621","doi":"","title":"Entropy-based Sentence Selection with Roget's Thesaurus","year":2010,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Automatic summarization; Sentence; Computer science; Thesaurus; Information retrieval; Natural language processing; Selection (genetic algorithm); Baseline (sea); Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005009776,0.001801442,0.002071983,0.003328146,0.001266949,0.002538613,0.001609839,0.001519916,0.005682188],"category_scores_gemma":[0.0130824,0.0005921758,0.001165707,0.001760677,0.0005968541,0.002500105,0.001826991,0.001403937,0.00306223],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001290471,"about_ca_system_score_gemma":0.002115383,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01202224,"about_ca_topic_score_gemma":0.02201394,"domain_scores_codex":[0.9964492,0.001322654,0.0003965368,0.000728904,0.0009064119,0.0001961837],"domain_scores_gemma":[0.9927801,0.002870138,0.0002672027,0.0008434422,0.002980057,0.0002589694],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.001352878,0.000406878,0.002777116,0.001134754,0.000615509,0.0004626099,0.001486934,0.01238745,0.08498825,0.001625381,0.04749075,0.8452716],"study_design_scores_gemma":[0.001648372,0.004724144,0.02455189,0.0002341235,0.001758044,0.001426726,0.002644716,0.501247,0.3238271,0.009173122,0.1279227,0.0008420525],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2869264,0.005331153,0.6010807,0.003197292,0.001695096,0.00214056,0.009399322,0.08026146,0.009968014],"genre_scores_gemma":[0.4149911,0.001134508,0.5413459,0.000735606,0.0006469167,0.0009527132,0.02035268,0.002505456,0.01733521],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01202224,"threshold_uncertainty_score":0.0264945,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.008418135404538249,"score_gpt":0.207359724092659,"score_spread":0.1989415886881207,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}