{"id":"W4385572479","doi":"10.18653/v1/2023.codi-1.9","title":"Entity-based SpanCopy for Abstractive Summarization to Improve the Factual Consistency","year":2023,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"Huawei Technologies","keywords":"Automatic summarization; Computer science; Consistency (knowledge bases); Relevance (law); Information retrieval; Multi-document summarization; Natural language processing; Component (thermodynamics); Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002484927,0.00006873316,0.00006961551,0.00006353149,0.0001431139,0.0001236688,0.0003941767,0.00003093782,0.00001353173],"category_scores_gemma":[0.0001331438,0.00004899714,0.00004487393,0.0002630589,0.00001307159,0.0001725205,0.00009449299,0.00004948199,0.0001243495],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002742193,"about_ca_system_score_gemma":0.0001017985,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00008313811,"about_ca_topic_score_gemma":0.00007414861,"domain_scores_codex":[0.9992476,0.00001641234,0.0001347165,0.0002622973,0.0001517485,0.0001872813],"domain_scores_gemma":[0.9991767,0.0002807703,0.00003747654,0.0003624844,0.00009751081,0.00004510205],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00004432127,0.0001134953,0.001153828,0.00008296654,0.00006816424,0.000007463283,0.004051758,0.0384162,0.02375426,0.6505666,0.01800763,0.2637333],"study_design_scores_gemma":[0.0003634811,0.00009137238,0.00236523,0.00000774296,0.000006112832,3.908571e-7,0.0001878879,0.9569427,0.02249742,0.009319297,0.008047662,0.0001706466],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01454099,0.000001811747,0.9780825,0.00446559,0.0006012277,0.0004611449,0.00000738094,0.0002203929,0.001618981],"genre_scores_gemma":[0.9318147,5.859423e-7,0.06522792,0.001354265,0.00008206427,0.00009442662,0.000007828525,0.000006786704,0.001411477],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9185265,"threshold_uncertainty_score":0.1998045,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03114916935483263,"score_gpt":0.2804351039777526,"score_spread":0.24928593462292,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}