{"id":"W2342302999","doi":"","title":"Policy Optimization by Marginal-MAP Probabilistic Inference in Generative Models (Extended Abstract)","year":2014,"lang":"en","type":"article","venue":"","topic":"Machine Learning and Algorithms","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Partially observable Markov decision process; Computer science; Inference; Generative model; Probabilistic logic; Bounded function; Mathematical optimization; Representation (politics); Machine learning; Generative grammar; Bayesian inference; Artificial intelligence; Task (project management); Bayesian probability; Mathematics; Markov model; Markov chain","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001872205,0.0008914495,0.00139003,0.0006060564,0.0005096396,0.001376365,0.002020544,0.001154723,0.00468236],"category_scores_gemma":[0.007253989,0.0008017505,0.001312931,0.001214113,0.001864155,0.001932416,0.003017253,0.002605976,0.0006296734],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001626178,"about_ca_system_score_gemma":0.001874789,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008781197,"about_ca_topic_score_gemma":0.00765105,"domain_scores_codex":[0.9991214,0.0003180395,0.00003391463,0.0001897575,0.0002334179,0.0001034029],"domain_scores_gemma":[0.9977829,0.001628895,0.0001334729,0.000207608,0.0001492215,0.00009788767],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003587568,0.00002340333,0.0002329737,0.00004999567,0.00002858356,0.0000315728,0.00004765491,0.9266604,0.0003880664,0.05824612,0.000978977,0.01327634],"study_design_scores_gemma":[0.000004004919,0.000004833849,0.00002134923,0.000003955377,0.000003819844,0.000005111408,0.000004020536,0.9725136,0.0001733135,0.02700178,0.0002612493,0.000003008808],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.002848455,0.00007454846,0.9956642,0.0001619685,0.00001529341,0.00001324705,0.00004406277,0.0001593464,0.001018911],"genre_scores_gemma":[0.5289293,0.0003728425,0.4648211,0.0003289206,0.0001104689,0.0003231367,0.0003199892,0.0003234971,0.00447068],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008781197,"threshold_uncertainty_score":0.01746017,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01169152630604252,"score_gpt":0.265539861251298,"score_spread":0.2538483349452554,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}