{"id":"W4416251343","doi":"10.1109/ijcnn64981.2025.11227725","title":"Navigation With QPHIL: Quantizing Planner for Hierarchical Implicit Q-Learning","year":2025,"lang":"en","type":"article","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ubisoft (Canada)","funders":"","keywords":"Reinforcement learning; Trajectory; Planner; Image stitching; Motion planning; Path (computing); State space; Range (aeronautics); Function (biology)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007936036,0.0007112768,0.0008441762,0.0002956644,0.0002859843,0.0006638096,0.001625441,0.0008163797,0.004944135],"category_scores_gemma":[0.002516919,0.0004138931,0.00040631,0.0003345777,0.0009886274,0.0009808681,0.001750711,0.001742332,0.0007827436],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006565709,"about_ca_system_score_gemma":0.001752303,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005182086,"about_ca_topic_score_gemma":0.006502741,"domain_scores_codex":[0.9996547,0.00007077115,0.0000217339,0.00008996294,0.0001154253,0.00004748365],"domain_scores_gemma":[0.9991954,0.0004478321,0.00006486231,0.0001283179,0.0001055772,0.00005795011],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001289545,0.00007083249,0.000473272,0.0001473206,0.00002387761,0.00008507514,0.0001449192,0.8133109,0.00361488,0.02448132,0.001972874,0.1555458],"study_design_scores_gemma":[0.00001477724,0.00002172505,0.00002618695,0.000004581501,0.000002668576,0.000007236454,0.000004118385,0.9950531,0.0003875195,0.00409005,0.0003853078,0.00000263684],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.004549847,0.0000901527,0.9932758,0.00005477276,0.00001948681,0.00003873347,0.00003555108,0.000874434,0.001061349],"genre_scores_gemma":[0.654678,0.0001751845,0.3410301,0.0001819044,0.00003867779,0.0002503832,0.0002172842,0.0002250031,0.003203464],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005182086,"threshold_uncertainty_score":0.01653981,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01112330068257593,"score_gpt":0.2746747569265827,"score_spread":0.2635514562440068,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}