{"id":"W3125267060","doi":"10.2514/1.a34838","title":"Deep Reinforcement Learning for Spacecraft Proximity Operations Guidance","year":2021,"lang":"en","type":"article","venue":"Journal of Spacecraft and Rockets","topic":"Space Satellite Systems and Control","field":"Engineering","cited_by":103,"is_retracted":false,"has_abstract":true,"ca_institutions":"Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Spacecraft; Computer science; Artificial intelligence; Controller (irrigation); Simulation; Flight simulator; Control engineering; Aerospace engineering; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004655116,0.0005345797,0.0004312803,0.0001606,0.0001789448,0.0003687921,0.000582471,0.0005569588,0.001455035],"category_scores_gemma":[0.001525476,0.0002034405,0.0002041759,0.0001392377,0.0005157394,0.0004317247,0.0006017,0.001179141,0.0002058645],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006130583,"about_ca_system_score_gemma":0.0007761742,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005447699,"about_ca_topic_score_gemma":0.004531382,"domain_scores_codex":[0.9998306,0.00004575798,0.00000704271,0.00003179933,0.00005396536,0.00003074865],"domain_scores_gemma":[0.9996402,0.0001770022,0.00005096802,0.00002617963,0.00007892118,0.00002672859],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00004966855,0.00004107831,0.000415259,0.00003554096,0.0000181358,0.00003808866,0.00002197376,0.9550339,0.002498799,0.004913299,0.0008025981,0.03613165],"study_design_scores_gemma":[0.000003472358,0.00001639858,0.00003991926,0.000001956177,0.00000161324,0.000003226076,0.000001363957,0.9981337,0.0003542461,0.001245885,0.0001967083,0.000001448766],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03307642,0.0005818895,0.9611801,0.0003162131,0.00007241576,0.00002902915,0.00003897609,0.0008158996,0.003889078],"genre_scores_gemma":[0.9554046,0.0001746563,0.041703,0.000104414,0.00002368728,0.000045474,0.00005322756,0.00003411268,0.002456941],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005447699,"threshold_uncertainty_score":0.01083195,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.008570806722344435,"score_gpt":0.222012698461574,"score_spread":0.2134418917392296,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}