{"id":"W2171609577","doi":"10.1109/ical.2009.5262570","title":"Neural Q-learning in motion planning for mobile robot","year":2009,"lang":"en","type":"article","venue":"","topic":"Advanced Algorithms and Applications","field":"Engineering","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Reinforcement learning; Convergence (economics); Q-learning; Computer science; Property (philosophy); Artificial neural network; Mobile robot; Motion planning; Artificial intelligence; Motion (physics); Robot; Robot learning; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001242541,0.0003498673,0.000576239,0.0003199995,0.0004388271,0.0004948131,0.0007383652,0.0007599954,0.001236503],"category_scores_gemma":[0.003031903,0.0002459161,0.000290728,0.0005222574,0.001045764,0.000946258,0.0005579466,0.0007740282,0.000147112],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001091672,"about_ca_system_score_gemma":0.001097556,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009401161,"about_ca_topic_score_gemma":0.004231569,"domain_scores_codex":[0.9995517,0.000190624,0.00002381754,0.000072371,0.000112332,0.00004907835],"domain_scores_gemma":[0.9993767,0.0004128127,0.00004637301,0.00002146317,0.0001202338,0.00002250686],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00005471864,0.0000416522,0.0004749726,0.00009966995,0.00002524853,0.00008392323,0.00008608744,0.8863013,0.0008599387,0.04719656,0.0008264455,0.06394951],"study_design_scores_gemma":[0.000009819432,0.00001767001,0.00005599751,0.000003364073,0.000003035057,0.000008256909,0.000004204422,0.988342,0.0001434962,0.01112339,0.0002859589,0.000002897616],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.009750627,0.0006228156,0.9874621,0.0002747238,0.00004026478,0.00002806766,0.000007685129,0.00008683741,0.001726852],"genre_scores_gemma":[0.8434896,0.0008391652,0.1518642,0.0001813173,0.0000951389,0.0002393715,0.00004038501,0.00002376926,0.003226969],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009401161,"threshold_uncertainty_score":0.01869291,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01066909240656045,"score_gpt":0.2664143892816936,"score_spread":0.2557452968751332,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}