{"id":"W178133203","doi":"10.1609/aaai.v25i1.7796","title":"Policy Gradient Planning for Environmental Decision Making with Existing Simulators","year":2011,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Forest Management and Policy","field":"Environmental Science","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Parameterized complexity; Computer science; Markov chain; Markov decision process; Domain (mathematical analysis); Operations research; Mathematical optimization; Markov process; Machine learning; Algorithm; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001904005,0.0008754935,0.0009868024,0.000573274,0.0005254887,0.001015218,0.001378305,0.001040356,0.002913807],"category_scores_gemma":[0.008112629,0.0006445398,0.0006263321,0.0004721178,0.0013957,0.001608372,0.001237258,0.001672973,0.000424851],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001896054,"about_ca_system_score_gemma":0.002239037,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009369384,"about_ca_topic_score_gemma":0.008571077,"domain_scores_codex":[0.9992606,0.0003284332,0.00003603497,0.0001090061,0.000194778,0.0000711461],"domain_scores_gemma":[0.9975722,0.001837039,0.0001226716,0.0001939176,0.0001933934,0.00008074794],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002556456,0.00002292113,0.0001785829,0.0000165696,0.000009028085,0.00001519522,0.00002611718,0.979648,0.0001280797,0.01260612,0.000158284,0.007165566],"study_design_scores_gemma":[0.000005062729,0.00000456051,0.000008856322,0.000002173488,0.000001435918,0.000001302757,0.000001614307,0.9955843,0.00007635024,0.004137136,0.0001761434,0.000001180576],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0182205,0.0001498336,0.9763815,0.0002239219,0.00002825079,0.00009403908,0.00005335474,0.0007658539,0.004082755],"genre_scores_gemma":[0.6702452,0.0002858413,0.325884,0.0001644405,0.00003081251,0.0004662764,0.0001851164,0.0001816145,0.002556705],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.009369384,"threshold_uncertainty_score":0.01862967,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1054500535485158,"score_gpt":0.315841546250156,"score_spread":0.2103914927016401,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}