{"id":"W2997123841","doi":"10.1609/aaai.v34i04.5885","title":"Monte-Carlo Tree Search in Continuous Action Spaces with Value Gradients","year":2020,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Artificial Intelligence in Games","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; Mila - Quebec Artificial Intelligence Institute; Kootenay Association for Science & Technology","funders":"Institute for Information and Communications Technology Promotion; Ministry of Science and ICT, South Korea; Iran Telecommunication Research Center; National Research Foundation","keywords":"Monte Carlo tree search; Discretization; Smoothness; Action (physics); Tree (set theory); Mathematical optimization; Computer science; Monte Carlo method; Set (abstract data type); Space (punctuation); Mathematics; Discrete space; Exploit; Algorithm; Mathematical analysis","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001799693,0.0009936558,0.001695828,0.0007315312,0.0005911086,0.0009383936,0.001673782,0.001554275,0.002839302],"category_scores_gemma":[0.007162802,0.0007497347,0.0007497672,0.001031538,0.001487561,0.001680852,0.00127208,0.001865856,0.0004882677],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001323857,"about_ca_system_score_gemma":0.002402034,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01228061,"about_ca_topic_score_gemma":0.01234556,"domain_scores_codex":[0.9992181,0.0003179077,0.0000431679,0.0001470817,0.0001892737,0.00008444299],"domain_scores_gemma":[0.9964414,0.002809064,0.0001696786,0.0001814788,0.0002398319,0.0001585278],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00007600476,0.00003443678,0.0004921677,0.00005654387,0.00002446983,0.00004931298,0.0000432975,0.9549979,0.0003022588,0.01668732,0.001035602,0.02620074],"study_design_scores_gemma":[0.0000100195,0.000009992354,0.00002672739,0.000004774362,0.000002642231,0.000006209537,0.000002759571,0.9944618,0.00008616153,0.00515009,0.0002366869,0.000002045744],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02268371,0.0006840969,0.9716269,0.0002891715,0.00007123245,0.00008673946,0.00007659783,0.0007425147,0.003739072],"genre_scores_gemma":[0.596566,0.0003262006,0.3987561,0.0003312863,0.00006895074,0.0003187642,0.0002765489,0.0002693459,0.003086622],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01228061,"threshold_uncertainty_score":0.02441823,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1234016045069758,"score_gpt":0.3139371520565129,"score_spread":0.1905355475495371,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}