{"id":"W4293428470","doi":"10.1109/tai.2022.3201807","title":"Optimizing Multidocument Summarization by Blending Reinforcement Learning Policies","year":2022,"lang":"en","type":"article","venue":"IEEE Transactions on Artificial Intelligence","topic":"Topic Modeling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"National Science Foundation","keywords":"Automatic summarization; Computer science; Reinforcement learning; Relevance (law); Redundancy (engineering); Multi-document summarization; Sentence; Artificial intelligence; Quality (philosophy); Machine learning; Information retrieval; Natural language processing","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00271945,0.001398699,0.001637166,0.001039372,0.0004598564,0.001117395,0.001197242,0.001698498,0.001531585],"category_scores_gemma":[0.00731113,0.0005997971,0.0007485653,0.000982467,0.0006504969,0.002248365,0.001113007,0.001570469,0.0005819066],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00128664,"about_ca_system_score_gemma":0.001363416,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002592189,"about_ca_topic_score_gemma":0.003237475,"domain_scores_codex":[0.998868,0.0003937366,0.00009743156,0.0003301724,0.0002224067,0.00008828404],"domain_scores_gemma":[0.9965205,0.002301719,0.0003909412,0.0001988337,0.0004342236,0.0001538462],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002169113,0.0002918958,0.0009648538,0.0002614514,0.0001094195,0.0001289215,0.0001933808,0.7688207,0.01335296,0.003520694,0.001533332,0.2106054],"study_design_scores_gemma":[0.00002634252,0.00007798693,0.0001039513,0.000007370599,0.00001719249,0.00001467561,0.0000146494,0.9937794,0.003180128,0.002205654,0.0005644914,0.000008260806],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03227767,0.0006708348,0.9638765,0.0002772668,0.0000479116,0.0001356326,0.00006570057,0.00169062,0.0009577724],"genre_scores_gemma":[0.5039702,0.0005549047,0.4901277,0.0003324677,0.0001504134,0.0004396265,0.0004858907,0.000348998,0.003589696],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.00271945,"threshold_uncertainty_score":0.014382,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04336013915883275,"score_gpt":0.2878445156778042,"score_spread":0.2444843765189715,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}