{"id":"W4413319271","doi":"10.1109/arso64737.2025.11124980","title":"Deep Reinforcement Learning for Robotic Grasping: Insights into Learning from Raw Visual Data","year":2025,"lang":"en","type":"article","venue":"","topic":"Robot Manipulation and Learning","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Sherbrooke","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Computer science; Artificial intelligence; Raw data; Deep learning; Human–computer interaction; Robot learning; Computer vision; Robot; Mobile robot","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001048914,0.000629401,0.0005927455,0.0002842604,0.0002058662,0.0006969722,0.0009423654,0.0007350593,0.001405651],"category_scores_gemma":[0.004362074,0.0003863966,0.0003529507,0.0002317147,0.0009424284,0.001271773,0.0009104091,0.001337544,0.0001745041],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008846456,"about_ca_system_score_gemma":0.0008354962,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002983005,"about_ca_topic_score_gemma":0.002361802,"domain_scores_codex":[0.9997696,0.00008361332,0.00001068779,0.00004423876,0.000060913,0.00003087474],"domain_scores_gemma":[0.9989121,0.00069371,0.0001212412,0.0001093236,0.0001121341,0.00005150546],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002780753,0.00002933273,0.0003622466,0.00004077152,0.00001324252,0.00004047369,0.00002888218,0.9690356,0.002204562,0.01209976,0.0002290329,0.01588826],"study_design_scores_gemma":[0.000002144028,0.00001282882,0.00004617084,0.000002675854,0.000001001732,0.000004843082,0.000001575375,0.9948025,0.000393336,0.004642188,0.00008880298,0.000002005215],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02624557,0.0002323408,0.9712259,0.0002942387,0.00002622503,0.00002380427,0.00003044147,0.0003080394,0.001613467],"genre_scores_gemma":[0.9079638,0.0002691986,0.08983969,0.0001196045,0.00002722732,0.00007634315,0.00005844736,0.00009378742,0.001551847],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002983005,"threshold_uncertainty_score":0.006418645,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03555892906706197,"score_gpt":0.2869290723871008,"score_spread":0.2513701433200388,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}