{"id":"W2998102890","doi":"10.1109/tac.2019.2907172","title":"Asymptotic Optimality of Finite Model Approximations for Partially Observed Markov Decision Processes With Discounted Cost","year":2019,"lang":"en","type":"article","venue":"IEEE Transactions on Automatic Control","topic":"Advanced Control Systems Optimization","field":"Engineering","cited_by":21,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Markov decision process; Partially observable Markov decision process; Mathematics; Finite state; Mathematical optimization; Markov process; State space; Applied mathematics; Finite set; Markov chain; Quantization (signal processing); Markov kernel; Space (punctuation); Markov model; Variable-order Markov model; Computer science; Algorithm; Mathematical analysis; Statistics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006058096,0.001392197,0.002226763,0.001197267,0.0006615042,0.002549676,0.002290695,0.001736678,0.00219497],"category_scores_gemma":[0.03244031,0.0009892725,0.001489947,0.0008089604,0.002719936,0.003449958,0.002727448,0.003071437,0.0002330187],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004400192,"about_ca_system_score_gemma":0.002619973,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01212154,"about_ca_topic_score_gemma":0.006379504,"domain_scores_codex":[0.9970049,0.001539906,0.0001298406,0.0003509924,0.0006549704,0.0003194099],"domain_scores_gemma":[0.9789432,0.01794579,0.00114822,0.0006256228,0.0008551045,0.0004821487],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00006833523,0.0000292633,0.0004364324,0.00007602009,0.00004270853,0.00005769966,0.00007039028,0.9070769,0.0002356007,0.08838161,0.0002551387,0.003269973],"study_design_scores_gemma":[0.000004461363,0.00001075358,0.00003831509,0.00001021107,0.000003721701,0.000005008516,0.000006062953,0.9762853,0.00005328013,0.02351473,0.00006421057,0.000004015822],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04768113,0.0008714247,0.9466009,0.0006299496,0.00005148022,0.0000430341,0.0001322662,0.0001624389,0.003827355],"genre_scores_gemma":[0.9198542,0.0009335723,0.07516667,0.0001622736,0.00007459143,0.0002253988,0.0003650012,0.0001222148,0.003095987],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01212154,"threshold_uncertainty_score":0.03203869,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01354082472989133,"score_gpt":0.2283057213937988,"score_spread":0.2147648966639075,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}