{"id":"W2734480429","doi":"10.1101/161638","title":"Large-Scale Uniform Analysis of Cancer Whole Genomes in Multiple Computing Environments","year":2017,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Cancer Genomics and Diagnostics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":29,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ontario Genomics; Hospital for Sick Children; University of Toronto; Ontario Institute for Cancer Research","funders":"Barcelona Supercomputing Center; Partnership for Advanced Computing in Europe AISBL","keywords":"Workflow; Replicate; Coding (social sciences); Genome; Computer science; Categorization; Software; Germline; Toolbox; Artifact (error); Data mining; Computational biology; Data science; Biology; Genetics; Statistics; Artificial intelligence; Database; Mathematics; Gene","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0003436251,0.0003564502,0.0006252743,0.0002686547,0.0001189395,0.00007150097,0.0006007754,0.00044004,0.00001529732],"category_scores_gemma":[0.0001004345,0.0004175965,0.0002538629,0.000201804,0.000113234,0.000005358574,0.0009681588,0.0002719197,0.000004333045],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001591162,"about_ca_system_score_gemma":0.0003199147,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000398447,"about_ca_topic_score_gemma":0.0007281718,"domain_scores_codex":[0.99804,0.00004119656,0.0004909496,0.0007945816,0.0001933716,0.0004398612],"domain_scores_gemma":[0.997752,0.00002513101,0.0005983111,0.001389375,0.00009948041,0.0001356851],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","study_design_scores_codex":[0.0000301967,0.0001598245,0.3860364,0.00008775791,0.0007779928,0.0000069412,0.00002215589,0.01255622,0.6002436,0.00001068095,0.00005997296,0.000008255362],"study_design_scores_gemma":[0.0009070335,0.00004397863,0.6652643,0.0001318542,0.000645886,2.12391e-9,0.00001087997,0.00939296,0.3003815,7.250783e-7,0.02257326,0.0006476426],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9902664,0.005310655,0.0017837,0.00004164988,0.0003921875,0.0003195453,0.001865616,0.00001139738,0.000008876473],"genre_scores_gemma":[0.9950823,0.003069487,0.001381587,0.00008501379,0.0002442449,0.000052858,0.00001156909,0.00006248387,0.00001047393],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2998621,"threshold_uncertainty_score":0.9998276,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01079465338454422,"score_gpt":0.2358577805990935,"score_spread":0.2250631272145493,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}