{"id":"W2771761215","doi":"10.1186/s12859-019-2916-0","title":"A multivariate Poisson-log normal mixture model for clustering transcriptome sequencing data","year":2019,"lang":"en","type":"preprint","venue":"BMC Bioinformatics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University; University of Guelph","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"Cluster analysis; Mixture model; Overdispersion; Markov chain Monte Carlo; Computer science; Multivariate statistics; Expectation–maximization algorithm; Context (archaeology); Poisson distribution; Count data; Data mining; Mathematics; Statistics; Biology; Artificial intelligence; Machine learning; Bayesian probability","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01187374,0.001731556,0.00230849,0.003302407,0.001486781,0.003161391,0.006727972,0.003764539,0.005576333],"category_scores_gemma":[0.02546521,0.001486907,0.00378152,0.004679332,0.002284871,0.00327927,0.002553439,0.004561796,0.003959717],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003057148,"about_ca_system_score_gemma":0.00304079,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0175059,"about_ca_topic_score_gemma":0.01615713,"domain_scores_codex":[0.9940559,0.003238643,0.0002640329,0.001251357,0.0008609429,0.0003291545],"domain_scores_gemma":[0.9904156,0.006416971,0.0008629162,0.0008054236,0.001211509,0.0002876223],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003335646,0.0001242952,0.006590661,0.0004624739,0.0003112358,0.0003080473,0.0006298084,0.7433066,0.003148448,0.1745188,0.009673996,0.06059204],"study_design_scores_gemma":[0.00002169249,0.00002779962,0.0006461575,0.00003378853,0.00003039537,0.00009106031,0.00003051695,0.9512175,0.0003500388,0.04446497,0.003041955,0.00004418326],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004062818,0.0002487833,0.9935796,0.0002623401,0.00005201554,0.0001404787,0.0005876801,0.0005664053,0.0004998205],"genre_scores_gemma":[0.1710264,0.001275168,0.8047778,0.0006769492,0.0003312818,0.002725953,0.007384622,0.001083855,0.01071802],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0175059,"threshold_uncertainty_score":0.0627951,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1182697790224262,"score_gpt":0.3252396361446816,"score_spread":0.2069698571222554,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}