{"id":"W4386566695","doi":"10.18653/v1/2023.eacl-main.206","title":"The StatCan Dialogue Dataset: Retrieving Data Tables through Conversations with Genuine Intents","year":2023,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; Mila - Quebec Artificial Intelligence Institute","funders":"","keywords":"Conversation; Computer science; Task (project management); Table (database); Set (abstract data type); Data set; Information retrieval; Data science; Natural language processing; Artificial intelligence; Data mining; Linguistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002300465,0.002900877,0.001224153,0.003368123,0.002466442,0.002596653,0.003258063,0.003231575,0.008136845],"category_scores_gemma":[0.01343224,0.0005124266,0.001453037,0.003215457,0.001066136,0.002734634,0.002549931,0.002663377,0.01099865],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00292976,"about_ca_system_score_gemma":0.00403634,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.1004456,"about_ca_topic_score_gemma":0.1784702,"domain_scores_codex":[0.9957397,0.001710985,0.0003120329,0.0008802061,0.0009453325,0.0004116753],"domain_scores_gemma":[0.9936721,0.002759496,0.0002957221,0.001436661,0.001281782,0.0005542928],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001910852,0.001531312,0.02153116,0.002533542,0.0003945564,0.0009703593,0.002207193,0.01357818,0.005677466,0.003107848,0.8717566,0.07480097],"study_design_scores_gemma":[0.001085792,0.000827495,0.04950504,0.0007293375,0.000317324,0.001817128,0.007830921,0.1749042,0.01961163,0.01010735,0.7326669,0.0005969968],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.1387124,0.004115126,0.01468812,0.002386321,0.0008992423,0.001385182,0.7985182,0.02366976,0.01562563],"genre_scores_gemma":[0.09547059,0.0003734907,0.02188376,0.0005523547,0.0001378868,0.0007567303,0.8757336,0.0005494082,0.004542258],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.8995544,"threshold_uncertainty_score":0.1997218,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1111507670832012,"score_gpt":0.3048785513780047,"score_spread":0.1937277842948034,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}