{"id":"W3024196334","doi":"10.1016/j.jneumeth.2020.108777","title":"Probing relationships between reinforcement learning and simple behavioral strategies to understand probabilistic reward learning","year":2020,"lang":"en","type":"article","venue":"Journal of Neuroscience Methods","topic":"Behavioral and Psychological Studies","field":"Psychology","cited_by":5,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Metric (unit); Computer science; Reinforcement; Probabilistic logic; Artificial intelligence; Set (abstract data type); Machine learning; Empirical distribution function; Space (punctuation); Mathematical optimization; Mathematics; Statistics; Psychology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00110204,0.0004163238,0.0003335916,0.0002563467,0.0001181199,0.0007493083,0.0007094493,0.000522823,0.002999472],"category_scores_gemma":[0.01041199,0.0003733941,0.0002698496,0.0001940096,0.0006274879,0.001597172,0.0005195413,0.001629423,0.0001885976],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000396586,"about_ca_system_score_gemma":0.0004667804,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005463723,"about_ca_topic_score_gemma":0.000698095,"domain_scores_codex":[0.9996153,0.000160699,0.00001852978,0.00009338485,0.00007885646,0.00003324938],"domain_scores_gemma":[0.9950141,0.003796541,0.0005516714,0.0003673717,0.0001099726,0.0001602578],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.00123655,0.003302065,0.1317439,0.0005338034,0.0005404454,0.00026411,0.0008564803,0.1553487,0.4014473,0.1213231,0.000585019,0.1828186],"study_design_scores_gemma":[0.00005124643,0.0007633485,0.08571639,0.00001690647,0.00006847368,0.0002137972,0.0001112444,0.7836238,0.02120705,0.1077379,0.0004472385,0.00004266636],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8355883,0.0001277999,0.1606665,0.0002149316,0.00001539337,0.00005216549,0.00007275504,0.000121026,0.003141106],"genre_scores_gemma":[0.9840899,0.00005348372,0.01539633,0.00004522568,0.000004851218,0.00003022629,0.00002677553,0.00002251645,0.0003307853],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002999472,"threshold_uncertainty_score":0.01003426,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5802836429956181,"score_gpt":0.4937564425548462,"score_spread":0.08652720044077183,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}