{"id":"W3167653081","doi":"10.1101/2021.06.17.448848","title":"LongStitch: High-quality genome assembly correction and scaffolding using long reads","year":2021,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Canada's Michael Smith Genome Sciences Centre","funders":"National Institutes of Health; Genome British Columbia; Genome Canada","keywords":"Contig; Sequence assembly; Pipeline (software); Computer science; Genome; Scaffold; Nanopore sequencing; Scalability; Contiguity; Reference genome; Computational biology; Parallel computing; Biology; Genetics; Programming language; Gene","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003391885,0.001755183,0.00138134,0.001494666,0.001286595,0.00198216,0.002367062,0.001113049,0.01017495],"category_scores_gemma":[0.006679418,0.00119656,0.001581446,0.001396964,0.0008846717,0.001532361,0.002469048,0.002458636,0.006389346],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007911183,"about_ca_system_score_gemma":0.001911834,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00237945,"about_ca_topic_score_gemma":0.003796556,"domain_scores_codex":[0.9976379,0.0003216203,0.0002065736,0.0008311261,0.0008195187,0.0001832934],"domain_scores_gemma":[0.9948443,0.001849145,0.0006761824,0.001257949,0.001088745,0.0002836545],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001490253,0.0002815964,0.009336314,0.002724081,0.0005516761,0.001079347,0.0009113287,0.02397343,0.5493297,0.005928473,0.05813149,0.3462624],"study_design_scores_gemma":[0.0002173212,0.0004855536,0.006621971,0.0002391689,0.000160483,0.0008519272,0.000195188,0.1299102,0.7667204,0.004918109,0.08927406,0.0004056251],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06299434,0.001443531,0.8002157,0.000447414,0.0004497909,0.0005708706,0.01290142,0.1179142,0.003062714],"genre_scores_gemma":[0.1087798,0.000444504,0.8547527,0.000396221,0.0001212116,0.0006585515,0.02158917,0.008549551,0.004708195],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01017495,"threshold_uncertainty_score":0.0340386,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02082773530911958,"score_gpt":0.2469408619398801,"score_spread":0.2261131266307605,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}