{"id":"W3097732461","doi":"10.48550/arxiv.2011.02565","title":"Diversity-Enriched Option-Critic","year":2020,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Diversity (politics); Political science; Law","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00145455,0.0009361039,0.0009570317,0.0004435687,0.0003874237,0.0009477558,0.001398924,0.001197464,0.002430103],"category_scores_gemma":[0.004108062,0.0004732727,0.0006548542,0.0003709172,0.0011923,0.001073168,0.001485877,0.001907925,0.0004114151],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009936988,"about_ca_system_score_gemma":0.001187325,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001751425,"about_ca_topic_score_gemma":0.002337016,"domain_scores_codex":[0.9994325,0.0002077524,0.00002600411,0.0001195056,0.0001432272,0.00007107476],"domain_scores_gemma":[0.998346,0.001004683,0.0001600845,0.0001558657,0.000196571,0.0001368092],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00009950278,0.00003279821,0.0006902365,0.00004869751,0.00003211054,0.00009032949,0.00005123953,0.949946,0.001917945,0.01874035,0.0007684848,0.02758218],"study_design_scores_gemma":[0.00000909896,0.00002097745,0.00004968667,0.000005687683,0.000004786172,0.00001603161,0.000002845674,0.9924167,0.0004218605,0.006760611,0.0002869479,0.000004746244],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03352725,0.0002363248,0.9610822,0.0002699606,0.00004409245,0.0000494178,0.00007269476,0.0004765762,0.004241478],"genre_scores_gemma":[0.8833202,0.000121624,0.1117343,0.000141527,0.00003041606,0.0001324676,0.000122811,0.000101346,0.004295251],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002430103,"threshold_uncertainty_score":0.008129537,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1188464807474624,"score_gpt":0.1945581158372311,"score_spread":0.07571163508976872,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}