{"id":"W21176108","doi":"10.1111/j.1742-7843.2010.00655.x","title":"Topic Segmentation : A First Stage to Dialog-Based Information Extraction.","year":2001,"lang":"en","type":"article","venue":"NLPRS","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"","keywords":"Segmentation; Computer science; Dialog box; Information extraction; Artificial intelligence; Natural language processing; Hidden Markov model; Speech recognition; World Wide Web","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003087852,0.003002737,0.002105126,0.011139,0.002089927,0.00373371,0.002498693,0.002670517,0.01371516],"category_scores_gemma":[0.005537625,0.0008360325,0.002793939,0.005864418,0.0006043862,0.005175916,0.003078575,0.001918719,0.01195059],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001146686,"about_ca_system_score_gemma":0.002678487,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006231713,"about_ca_topic_score_gemma":0.008846205,"domain_scores_codex":[0.9973835,0.0006217832,0.0002978571,0.0008778066,0.0005085934,0.0003103871],"domain_scores_gemma":[0.9972144,0.001423819,0.0001583882,0.0003906047,0.0006004698,0.0002124578],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008017761,0.0003801351,0.004104978,0.00185694,0.0004008806,0.0005268946,0.001207163,0.002669426,0.03070962,0.005175165,0.05552555,0.8966414],"study_design_scores_gemma":[0.0002363291,0.001273299,0.02423609,0.0009298821,0.00138611,0.002578937,0.006205135,0.5532376,0.08415081,0.05474171,0.2705853,0.0004387568],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02103043,0.007569425,0.8798203,0.001373708,0.0007750961,0.002211341,0.02438341,0.05175575,0.01108044],"genre_scores_gemma":[0.1552708,0.00209731,0.7846671,0.0003840277,0.0007642869,0.001328609,0.04438111,0.001495669,0.009611067],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01371516,"threshold_uncertainty_score":0.04588175,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01560239395001572,"score_gpt":0.2559230316549126,"score_spread":0.2403206377048969,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}