{"id":"W7007950857","doi":"","title":"Assessing the quality of posterior samples from No-U-Turn Hamiltonian Monte Carlo","year":2020,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"McGill University","keywords":"Quality (philosophy); Stability (learning theory); Calculus (dental); Distribution (mathematics)","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.003273895,0.0011449,0.002111729,0.0002039297,0.0009902919,0.0002953,0.001440494,0.001065705,0.0001443745],"category_scores_gemma":[0.009736835,0.0009335222,0.001098059,0.000478282,0.0001339178,0.0006675383,0.0003477607,0.002199696,0.00000546259],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004138251,"about_ca_system_score_gemma":0.0001444885,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003090134,"about_ca_topic_score_gemma":0.005919375,"domain_scores_codex":[0.9915709,0.002503434,0.002357609,0.001358168,0.00143526,0.0007745794],"domain_scores_gemma":[0.9906775,0.003641628,0.002442059,0.001835452,0.001010177,0.0003931256],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.001174303,0.0006880027,0.0003299766,0.005606458,0.002399977,0.0001411685,0.0007228243,0.000009051846,0.5816624,0.1124049,0.00009711555,0.2947638],"study_design_scores_gemma":[0.008600526,0.001147572,0.02547159,0.01041601,0.005787076,0.00006385275,0.02847515,0.0005787315,0.4627033,0.1708981,0.274726,0.01113211],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9439996,0.0005477651,0.000004157249,0.00006059368,0.002038422,0.001069325,0.003981268,0.0002455352,0.04805336],"genre_scores_gemma":[0.9611807,0.0001679262,0.03229032,0.0004669623,0.000246548,0.0001541961,0.0007208878,0.0004155495,0.004356942],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2836317,"threshold_uncertainty_score":0.9993115,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1142452534654372,"score_gpt":0.3801010563703571,"score_spread":0.2658558029049199,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}