{"id":"W2899026301","doi":"10.1109/access.2018.2878894","title":"Distributed Reinforcement Learning in Emergency Response Simulation","year":2018,"lang":"en","type":"article","venue":"IEEE Access","topic":"Infrastructure Resilience and Vulnerability Analysis","field":"Engineering","cited_by":22,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Reinforcement learning; Computer science; Convergence (economics); Scheme (mathematics); Interdependence; Process (computing); Curse of dimensionality; Artificial intelligence; Emergency response; Distributed computing; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001485464,0.0006836238,0.0009097236,0.0002896998,0.0003924905,0.0006479056,0.001142172,0.0008301499,0.001590224],"category_scores_gemma":[0.004142042,0.0004303517,0.0003886331,0.000248362,0.001024482,0.0006500996,0.001082321,0.00111362,0.0001990561],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001073585,"about_ca_system_score_gemma":0.001011629,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008920156,"about_ca_topic_score_gemma":0.004374901,"domain_scores_codex":[0.9991673,0.000454876,0.00003479932,0.0001106716,0.0001283993,0.0001039612],"domain_scores_gemma":[0.9977934,0.001507485,0.0001624987,0.0001457685,0.0002514847,0.0001393636],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000195063,0.00001309193,0.0002014331,0.000006611296,0.00000530417,0.00001326493,0.0000106466,0.9967811,0.0001503539,0.0009540826,0.00004714013,0.001797394],"study_design_scores_gemma":[0.000006750958,0.000007478005,0.00002649684,9.420122e-7,9.981603e-7,0.00000189804,0.000002010445,0.9991502,0.00009267173,0.0006369423,0.0000725606,0.000001093268],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1365284,0.0003156436,0.8560942,0.0004563221,0.00007726617,0.0001279077,0.00006404569,0.0009709448,0.005365199],"genre_scores_gemma":[0.9570017,0.00006713194,0.041727,0.00003870879,0.00001342317,0.0001015484,0.00003490187,0.00003591871,0.0009796807],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008920156,"threshold_uncertainty_score":0.01773649,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01676639656093099,"score_gpt":0.310017595011586,"score_spread":0.293251198450655,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}