{"id":"W2950896295","doi":"10.1093/nar/gkw957","title":"Using predictive specificity to determine when gene set analysis is biologically meaningful","year":2016,"lang":"en","type":"article","venue":"Nucleic Acids Research","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":33,"is_retracted":false,"has_abstract":true,"ca_institutions":"Canada's Michael Smith Genome Sciences Centre; University of British Columbia","funders":"National Institute of General Medical Sciences; National Institutes of Health","keywords":"Biology; Computational biology; Set (abstract data type); Gene; Genetics; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03325284,0.002054278,0.001882122,0.008851588,0.001510317,0.005209581,0.001921416,0.002824083,0.004200267],"category_scores_gemma":[0.1489264,0.0007785574,0.002425137,0.004101483,0.003751906,0.00378035,0.00356612,0.003765793,0.002257797],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001273202,"about_ca_system_score_gemma":0.001296759,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001531801,"about_ca_topic_score_gemma":0.001960665,"domain_scores_codex":[0.9820693,0.006406882,0.001702274,0.003670844,0.005202486,0.0009482838],"domain_scores_gemma":[0.8501756,0.117355,0.008556855,0.01351421,0.008852397,0.001545983],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002679478,0.0003794813,0.4790331,0.002878976,0.002400722,0.001069058,0.001479129,0.08049063,0.07898844,0.03155001,0.00956716,0.3094838],"study_design_scores_gemma":[0.0001728019,0.001067244,0.1296547,0.0009188266,0.002113358,0.002741097,0.00109091,0.5152731,0.1897317,0.1381719,0.01857087,0.0004934864],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.2316873,0.002965509,0.7327897,0.001656228,0.000448291,0.000435445,0.003295533,0.009386485,0.01733545],"genre_scores_gemma":[0.8529837,0.0005307832,0.1396498,0.0008355928,0.000178758,0.0002964369,0.003025728,0.001157264,0.001341917],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.03325284,"threshold_uncertainty_score":0.1758599,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0868051577310736,"score_gpt":0.3433947270634509,"score_spread":0.2565895693323773,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}