{"id":"W3031516940","doi":"10.48550/arxiv.2003.10249","title":"Using Deep Reinforcement Learning Methods for Autonomous Vessels in 2D Environments","year":2020,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Maritime Navigation and Safety","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Reinforcement learning; Computer science; Artificial intelligence; Context (archaeology); Motion planning; Agile software development; Planner; Bellman equation; Function (biology); Machine learning; Robot; Mathematical optimization; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008372332,0.0007921899,0.0005782075,0.0003196046,0.0002891027,0.0006149427,0.0008463963,0.0008517287,0.001307445],"category_scores_gemma":[0.00212744,0.0003932774,0.0004156065,0.0002809128,0.0007707389,0.0007806877,0.0009376603,0.001219584,0.0002248868],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008547702,"about_ca_system_score_gemma":0.0009435735,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008215177,"about_ca_topic_score_gemma":0.006376675,"domain_scores_codex":[0.9997641,0.00008626982,0.00001125595,0.00005390864,0.00004750348,0.00003693434],"domain_scores_gemma":[0.9992781,0.0004218743,0.00008567311,0.00004887157,0.0001210221,0.00004446372],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002013864,0.00001991782,0.0003779041,0.00001853964,0.00001404495,0.00001905368,0.00001645252,0.9799906,0.0006778798,0.001809007,0.0002286679,0.01680786],"study_design_scores_gemma":[0.000002325766,0.000007233187,0.00002438458,0.000001403652,0.000001227518,0.000001617221,0.000001371625,0.9987452,0.0001351843,0.0009972294,0.00008183868,0.000001006031],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02828593,0.0003612438,0.9690329,0.0002321,0.00005243697,0.00002828441,0.00003030062,0.0004895153,0.001487284],"genre_scores_gemma":[0.8791306,0.0002317314,0.118269,0.000138136,0.00003858188,0.0001042336,0.00008445505,0.00006754181,0.001935816],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008215177,"threshold_uncertainty_score":0.01633477,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09631121055334327,"score_gpt":0.2432798862094639,"score_spread":0.1469686756561207,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}