{"id":"W2909323034","doi":"10.1109/ghtc.2018.8601911","title":"Distributed Reinforcement Learning Framework for Resource Allocation in Disaster Response","year":2018,"lang":"en","type":"article","venue":"","topic":"Infrastructure Resilience and Vulnerability Analysis","field":"Engineering","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Reinforcement learning; Curse of dimensionality; Distributed computing; Interdependence; IBM; Convergence (economics); Artificial intelligence; Resource allocation; Machine learning; Computer network","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004185713,0.00009198757,0.000112785,0.00008745755,0.00007594054,0.00002957683,0.00009063996,0.00008934972,0.0001933941],"category_scores_gemma":[0.0004046393,0.00008269958,0.00004558688,0.0002853897,0.00004495757,0.00009047973,0.00001562313,0.0001445938,0.0000210417],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001011169,"about_ca_system_score_gemma":0.000009058958,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00000892998,"about_ca_topic_score_gemma":0.00003189002,"domain_scores_codex":[0.9992899,0.00004641679,0.0002126723,0.0001348932,0.00009909749,0.0002169864],"domain_scores_gemma":[0.9994947,0.0002275904,0.00001916746,0.000182118,0.00003953415,0.00003691489],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003095403,0.000006703659,0.001382538,0.00002700469,0.00002178993,3.68801e-7,0.00106538,0.9883152,0.00196474,0.002740093,0.0005474791,0.003619126],"study_design_scores_gemma":[0.0003473979,0.0001860749,0.007585185,0.00005619923,0.00001950971,9.350649e-7,0.00137026,0.9400913,0.0107465,0.002676866,0.03665809,0.0002617116],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2498182,0.000007485339,0.7491299,0.000170227,0.00003588463,0.0001171197,0.000001353719,0.00008280608,0.0006370291],"genre_scores_gemma":[0.9954086,0.00000201737,0.004133523,0.00006606353,0.00009081183,0.00003008487,0.0000354557,0.00001105137,0.0002223994],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7455904,"threshold_uncertainty_score":0.3372391,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.008590897151616081,"score_gpt":0.2537789281638684,"score_spread":0.2451880310122523,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}