{"id":"W7042606144","doi":"","title":"Probabilistic linear function approximation for value-based reinforcement learning","year":2005,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Healthcare professionals’ stress and burnout","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Reinforcement learning; Function approximation; Probabilistic logic; Temporal difference learning; Function (biology); Key (lock); Q-learning; State space","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003339979,0.001397917,0.002422536,0.001032974,0.0005435894,0.001545141,0.00231105,0.002037853,0.007021916],"category_scores_gemma":[0.01184944,0.0007947747,0.0008084421,0.001025129,0.001386301,0.001672227,0.001530163,0.003631821,0.00098132],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002833707,"about_ca_system_score_gemma":0.002505258,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01837834,"about_ca_topic_score_gemma":0.01366665,"domain_scores_codex":[0.9989202,0.0004909458,0.00005324922,0.0001911844,0.0001629462,0.0001815454],"domain_scores_gemma":[0.9919723,0.006803008,0.0002795552,0.000190138,0.0005552691,0.0001997253],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001205325,0.0001031335,0.0008251913,0.0001001636,0.00005668812,0.00004293383,0.00006091325,0.9319983,0.0001640348,0.01476874,0.002058016,0.04970136],"study_design_scores_gemma":[0.00001130817,0.00001619263,0.00004353603,0.000008245688,0.000004670492,0.000003358541,0.000004590817,0.9935436,0.00004106124,0.006123119,0.0001971744,0.000003158549],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01654853,0.001285907,0.97472,0.0008234971,0.0001728081,0.0001018285,0.000118412,0.0008903409,0.005338646],"genre_scores_gemma":[0.800343,0.001006434,0.1822763,0.0005884134,0.0002101199,0.00077054,0.0004973616,0.000207295,0.01410063],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01837834,"threshold_uncertainty_score":0.03654277,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04977065428048726,"score_gpt":0.3672766782670331,"score_spread":0.3175060239865458,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}