{"id":"W4417526858","doi":"10.1016/j.knosys.2025.115147","title":"DRONE-RL: Dynamic reinforcement learning for online navigation of UAVs in evolving environments","year":2025,"lang":"en","type":"article","venue":"Knowledge-Based Systems","topic":"UAV Applications and Optimization","field":"Engineering","cited_by":1,"is_retracted":false,"has_abstract":false,"ca_institutions":"Queen's University","funders":"Qatar National Research Fund; Qatar Research, Development and Innovation Council","keywords":"Reinforcement learning; Leverage (statistics); Regret; Adaptability; Benchmark (surveying); Motion planning; Online learning; Remotely operated underwater vehicle; Mobile robot","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006384493,0.0007211768,0.0008396307,0.0003132384,0.000286064,0.0006679638,0.00152301,0.001079211,0.003610803],"category_scores_gemma":[0.002177747,0.0003959881,0.0003653432,0.0002413161,0.0005919092,0.0007837807,0.00125756,0.001364149,0.0007342058],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000538454,"about_ca_system_score_gemma":0.0009879336,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009517809,"about_ca_topic_score_gemma":0.009881539,"domain_scores_codex":[0.9997868,0.00004918023,0.00001065443,0.00005365157,0.00006498276,0.0000348619],"domain_scores_gemma":[0.9994469,0.0002938235,0.00003823494,0.00006643531,0.000103929,0.00005068109],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001179349,0.00008188632,0.0003704611,0.00006525347,0.00003480175,0.00005735191,0.00004318688,0.9191955,0.001716074,0.003539956,0.002081665,0.07269605],"study_design_scores_gemma":[0.00001164393,0.00001252136,0.00002103001,0.000002158191,0.00000183103,0.000004899666,0.000001877166,0.998955,0.000297938,0.0004501476,0.0002392142,0.000001808923],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02035269,0.0002704053,0.9729988,0.0001413635,0.00008331328,0.00006306065,0.0000942471,0.002870723,0.0031254],"genre_scores_gemma":[0.7934288,0.0001560151,0.2010979,0.0001300017,0.00003558741,0.0001833205,0.0002289652,0.0002859054,0.004453487],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009517809,"threshold_uncertainty_score":0.01892483,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.006542416077665376,"score_gpt":0.2429424013699784,"score_spread":0.236399985292313,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}