{"id":"W7124301997","doi":"10.65109/tjqd1268","title":"PORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning","year":2023,"lang":"","type":"article","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Reinforcement learning; Task (project management); Curriculum; Feature (linguistics); Space (punctuation); Active learning (machine learning); Key (lock); Transfer of learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001655358,0.0008620048,0.0008986078,0.0004917594,0.0004100781,0.0006718481,0.001908493,0.001015964,0.005561862],"category_scores_gemma":[0.004514312,0.0004623726,0.0004857733,0.0002826624,0.0007299244,0.00102959,0.001824199,0.001634754,0.00113299],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008456893,"about_ca_system_score_gemma":0.001541541,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003035084,"about_ca_topic_score_gemma":0.003166137,"domain_scores_codex":[0.9994554,0.0002174425,0.00002869961,0.0001197687,0.0001163511,0.00006225871],"domain_scores_gemma":[0.9988742,0.0005670373,0.0001173406,0.0001443024,0.0001776242,0.0001194946],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002315012,0.0002888309,0.001736489,0.0001969501,0.00006694829,0.0001275374,0.0001431795,0.7384765,0.004067151,0.01755908,0.005921125,0.2311848],"study_design_scores_gemma":[0.00003266064,0.00002883892,0.00005438908,0.000004349684,0.00000294448,0.000008652566,0.000004466426,0.9952565,0.0005543677,0.003297535,0.0007517548,0.000003461338],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.007717907,0.00009536284,0.9872189,0.00009888394,0.00003806575,0.0001014202,0.00005259254,0.00365042,0.001026472],"genre_scores_gemma":[0.4602006,0.0001233221,0.5352926,0.0001794953,0.00004564165,0.0006918488,0.0003264329,0.0003793539,0.002760735],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005561862,"threshold_uncertainty_score":0.01860625,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05505160572722048,"score_gpt":0.3059342340578389,"score_spread":0.2508826283306185,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}