{"id":"W197688093","doi":"","title":"An Architecture for Distinguishing between Predictors and Inhibitors in Reinforcement Learning","year":2013,"lang":"en","type":"article","venue":"arXiv (Cornell University)","topic":"Behavioral and Psychological Studies","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Reinforcement learning; Reinforcement; Outcome (game theory); Artificial intelligence; Valence (chemistry); Value (mathematics); Machine learning; Computer science; Predictive value; Stimulus (psychology); Psychology; Mathematics; Cognitive psychology; Social psychology; Physics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001347484,0.0001329994,0.0001687964,0.00007906762,0.0001547342,0.00002613447,0.0001403643,0.0001121553,0.0001586255],"category_scores_gemma":[0.00002508387,0.0001189935,0.00003706898,0.0001900615,0.00009942788,0.0001123883,0.00004375375,0.0002424475,0.00001998251],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0000291812,"about_ca_system_score_gemma":0.000002695826,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006235878,"about_ca_topic_score_gemma":0.00006532537,"domain_scores_codex":[0.9990686,0.00007843882,0.0001368416,0.0003960245,0.00003001364,0.0002901526],"domain_scores_gemma":[0.9995308,0.0001217198,0.00006843846,0.0001346567,0.00003032731,0.000114064],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00004413303,0.00005019438,0.9866778,0.000009245176,0.00002495092,0.0000151894,0.001722318,0.002205328,0.0000667621,0.002666168,0.0003120126,0.006205945],"study_design_scores_gemma":[0.001089122,0.0007135014,0.9884464,0.00002748438,0.00004229689,0.00000114855,0.001697119,0.0005902635,0.00001238668,0.003605907,0.003507992,0.0002663378],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9928427,0.00003185459,0.004191941,0.0000805763,0.0001275125,0.0003521319,0.000003283382,0.00007221881,0.002297778],"genre_scores_gemma":[0.9987367,0.000007810273,0.00005161873,0.00004455731,0.0001105909,0.000006074645,0.000013106,0.00000969044,0.001019837],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005939608,"threshold_uncertainty_score":0.4852413,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1580840457850106,"score_gpt":0.2435297391578026,"score_spread":0.08544569337279201,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}