{"id":"W2599940792","doi":"10.24963/ijcai.2017/385","title":"End-to-end optimization of goal-driven and visually grounded dialogue systems","year":2017,"lang":"en","type":"article","venue":"","topic":"Multimodal Machine Learning Applications","field":"Computer Science","cited_by":89,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"Agence Nationale de la Recherche; Compute Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Canadian Institute for Advanced Research","keywords":"Computer science; Task (project management); Utterance; Artificial intelligence; Reinforcement learning; Sequence (biology); Object (grammar); Human–computer interaction; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002012165,0.001462614,0.001077029,0.0004120515,0.0005077871,0.001023977,0.001147903,0.001684338,0.002986537],"category_scores_gemma":[0.005030566,0.0006681335,0.0005389066,0.0001999563,0.001055071,0.0009668556,0.001841554,0.001666236,0.0005983359],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001325494,"about_ca_system_score_gemma":0.001754693,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00379398,"about_ca_topic_score_gemma":0.003766965,"domain_scores_codex":[0.9992028,0.000343115,0.00003179239,0.0001957223,0.0001063411,0.00012023],"domain_scores_gemma":[0.9982209,0.001218306,0.0001135234,0.00009052812,0.0002175595,0.0001392479],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001614269,0.00008772604,0.0003252307,0.00007179348,0.00002457164,0.00007706349,0.0001349516,0.962439,0.003337828,0.002672731,0.0007562634,0.02991138],"study_design_scores_gemma":[0.00001139595,0.00002421525,0.00003404039,0.000003472592,0.000002409893,0.000005501615,0.00001077644,0.997749,0.0005870737,0.001437631,0.0001318828,0.000002478275],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06235531,0.0003067872,0.9313652,0.0003233919,0.00005432195,0.0001691074,0.00009339854,0.001728103,0.003604401],"genre_scores_gemma":[0.8633749,0.00007855945,0.1329725,0.0001520469,0.00002066414,0.0002941886,0.0001751011,0.0002598951,0.002672196],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.00379398,"threshold_uncertainty_score":0.01064146,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01768662620118641,"score_gpt":0.293410836131722,"score_spread":0.2757242099305356,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}