{"id":"W4283802444","doi":"10.1609/aaai.v36i10.21325","title":"Predicting Above-Sentence Discourse Structure Using Distant Supervision from Topic Segmentation","year":2022,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Natural language processing; Computer science; Paragraph; Sentence; Parsing; Automatic summarization; Artificial intelligence; Segmentation; Task (project management); Semantic role labeling; Linguistics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001176493,0.00105374,0.0005578607,0.00182463,0.000739381,0.001009304,0.0006844793,0.0010833,0.002355441],"category_scores_gemma":[0.00439432,0.0003714876,0.000683717,0.001088481,0.0003821793,0.001990451,0.0008451339,0.001471164,0.002073809],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005900644,"about_ca_system_score_gemma":0.001004352,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0039072,"about_ca_topic_score_gemma":0.009540496,"domain_scores_codex":[0.9993698,0.00023197,0.00003270536,0.0002524611,0.00005787682,0.00005508968],"domain_scores_gemma":[0.9964598,0.002334958,0.0003353606,0.0002160128,0.0005105228,0.0001433524],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001816224,0.0007732751,0.03293547,0.00116237,0.000293692,0.0009220515,0.004336135,0.07319925,0.09828236,0.009527642,0.0353875,0.741364],"study_design_scores_gemma":[0.00007353424,0.0002083014,0.01243822,0.00009880083,0.0001481323,0.0001644346,0.0005780301,0.9348693,0.02565631,0.01393427,0.01178401,0.00004667715],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4206063,0.004435211,0.5505258,0.001604464,0.0003894744,0.0002876672,0.005737863,0.007781198,0.008632108],"genre_scores_gemma":[0.8553909,0.0007022794,0.126955,0.0001636927,0.0003715318,0.0002010545,0.01084345,0.0003626316,0.005009491],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.0039072,"threshold_uncertainty_score":0.007879674,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02308686032587811,"score_gpt":0.2733598464726859,"score_spread":0.2502729861468078,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}