{"id":"W4220966911","doi":"10.1145/3502727","title":"Stochastic Variational Optimization of a Hierarchical Dirichlet Process Latent Beta-Liouville Topic Model","year":2022,"lang":"en","type":"article","venue":"ACM Transactions on Knowledge Discovery from Data","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"","keywords":"Latent Dirichlet allocation; Dirichlet process; Hierarchical Dirichlet process; Topic model; Computer science; Measure (data warehouse); Dirichlet distribution; Inference; Prior probability; Parametric statistics; Bayesian inference; Posterior probability; Mathematics; Bayesian probability; Applied mathematics; Artificial intelligence; Data mining; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003003508,0.001084221,0.00188884,0.000955915,0.0005818132,0.001995345,0.002457764,0.002408809,0.004363791],"category_scores_gemma":[0.006316235,0.00106298,0.001511776,0.001371748,0.001741178,0.002190324,0.002179776,0.002525476,0.0007825039],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002122641,"about_ca_system_score_gemma":0.002415505,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009584678,"about_ca_topic_score_gemma":0.01055693,"domain_scores_codex":[0.9988552,0.0005477867,0.00003966273,0.0002479093,0.0001902646,0.0001191603],"domain_scores_gemma":[0.99804,0.001472193,0.000107111,0.00007957705,0.0002042008,0.00009703454],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000036371,0.00002785297,0.0004757103,0.00009379716,0.00003816555,0.00008849273,0.00009638261,0.8604539,0.0006214658,0.1261932,0.002169467,0.009705183],"study_design_scores_gemma":[0.000005873683,0.000004224346,0.00004242123,0.000005852576,0.000003264368,0.000007241191,0.000008244187,0.978869,0.00005936613,0.02044772,0.0005417023,0.000005115843],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007446159,0.000346289,0.9876891,0.0005571695,0.00004737103,0.00004750785,0.0001976751,0.00012457,0.003543992],"genre_scores_gemma":[0.4961058,0.001277062,0.4688516,0.0007188032,0.000316067,0.001006607,0.001578246,0.000601186,0.02954459],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.009584678,"threshold_uncertainty_score":0.01905775,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04890874881870901,"score_gpt":0.3044790594634345,"score_spread":0.2555703106447255,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}