{"id":"W7017161555","doi":"","title":"AlphaSMT: A Reinforcement Learning Guided SMT Solver","year":2023,"lang":"en","type":"dissertation","venue":"UWSpace (University of Waterloo)","topic":"Formal Methods in Verification","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Blackberry (Canada)","funders":"","keywords":"Satisfiability modulo theories; Reinforcement learning; Flexibility (engineering); Solver; Class (philosophy); Function (biology); Artificial neural network; Software","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0005334374,0.000252042,0.0003646992,0.0004505124,0.0003037433,0.00005966012,0.001371295,0.0002931602,0.00009815548],"category_scores_gemma":[0.00007335839,0.0003107765,0.0001959853,0.0005484661,0.00005571428,0.000617751,0.0002620767,0.0003765451,0.000408567],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001442215,"about_ca_system_score_gemma":0.0001269627,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01054686,"about_ca_topic_score_gemma":0.002593382,"domain_scores_codex":[0.9982324,0.0001198457,0.0002248462,0.0005217183,0.0005449619,0.0003562227],"domain_scores_gemma":[0.9983865,0.00004422742,0.0005103415,0.0006879401,0.0002699633,0.0001010091],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002993493,0.0001604195,0.0003202706,0.001604436,0.0006310111,0.0002303047,0.8178307,0.01732746,0.01716721,0.0406022,0.02744339,0.07638322],"study_design_scores_gemma":[0.004756669,0.001643609,0.01986527,0.00208739,0.0006293753,0.00003080289,0.355644,0.5263308,0.0460006,0.003639478,0.03514199,0.004229997],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"other","genre_scores_codex":[0.8885653,0.0001197043,0.09385207,0.00102618,0.004042905,0.001141417,0.000006939079,0.001480628,0.009764843],"genre_scores_gemma":[0.008883366,0.0001503894,0.1334777,0.00001767904,0.00003975085,0.000001476153,0.0002751226,0.00003389348,0.8571206],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8796819,"threshold_uncertainty_score":0.9999344,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02864262116072009,"score_gpt":0.2590200300961433,"score_spread":0.2303774089354232,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}