{"id":"W4393577040","doi":"10.1101/2024.04.01.587602","title":"Beyond Normalization: Incorporating Scale Uncertainty in Microbiome and Gene Expression Analysis","year":2024,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"National Institutes of Health","keywords":"False positive paradox; Normalization (sociology); Computer science; False positives and false negatives; Scale (ratio); Context (archaeology); Sample (material); False discovery rate; Statistics; Data mining; Artificial intelligence; Machine learning; Mathematics; Biology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02003087,0.002133606,0.001853117,0.002127351,0.00161418,0.005676584,0.002754328,0.002357741,0.002283861],"category_scores_gemma":[0.06355872,0.001071339,0.003162141,0.004039944,0.004047945,0.006634186,0.005109525,0.004856334,0.001314133],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002871956,"about_ca_system_score_gemma":0.003131827,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006875288,"about_ca_topic_score_gemma":0.006953248,"domain_scores_codex":[0.9878547,0.004579312,0.000581485,0.002938875,0.003507489,0.0005381257],"domain_scores_gemma":[0.9763455,0.01241342,0.002230472,0.005926161,0.002594173,0.0004902513],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0006202363,0.0002287708,0.02805463,0.0008388695,0.001050347,0.0004061664,0.001359006,0.3844079,0.03112811,0.2408007,0.01827251,0.2928328],"study_design_scores_gemma":[0.00003555752,0.00008349394,0.005667264,0.0001073399,0.000103848,0.0002020865,0.0001539661,0.6313452,0.01614616,0.3203005,0.02567617,0.000178437],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.007709959,0.0004550917,0.9871661,0.0007338685,0.0002025685,0.00006109586,0.0003290104,0.001855329,0.001486832],"genre_scores_gemma":[0.2561964,0.001060328,0.7300938,0.002061545,0.0006358289,0.0005896436,0.001597533,0.003536273,0.004228705],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02003087,"threshold_uncertainty_score":0.1059346,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.007420996002226026,"score_gpt":0.2225939207479362,"score_spread":0.2151729247457101,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}