{"id":"W2734809496","doi":"10.3934/medsci.2017.3.261","title":"The Role of The Prefix Array in Sequence Analysis: A Survey","year":2017,"lang":"en","type":"article","venue":"AIMS Medical Science","topic":"Algorithms and Data Compression","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University","funders":"","keywords":"Prefix; Sequence (biology); Computer science; Hamming distance; Algorithm; Array data structure; Extension (predicate logic); Theoretical computer science; Mathematics; Combinatorics; Biology; Genetics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.005213354,0.00007205125,0.0001324813,0.00005299084,0.001052152,0.0003295967,0.009834886,0.00004103728,0.000009481389],"category_scores_gemma":[0.003002117,0.00003245674,0.00005149794,0.001268282,0.001780103,0.0006879766,0.001648013,0.0001975366,0.000005782747],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002805336,"about_ca_system_score_gemma":0.0004960883,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002713664,"about_ca_topic_score_gemma":0.00215412,"domain_scores_codex":[0.9973897,0.0001473931,0.0002276534,0.0003709718,0.001540422,0.0003238267],"domain_scores_gemma":[0.9972569,0.0003053752,0.0002029982,0.001976705,0.00009947192,0.0001585335],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000007462591,0.0001102096,0.521431,0.000003355366,0.00002515796,0.000008201086,0.0007581554,0.00008708347,0.005353517,0.03046667,0.000156415,0.4415927],"study_design_scores_gemma":[0.00007455161,0.00001323362,0.8541988,0.00003239376,0.000003912232,0.000002128214,0.00001818145,0.137883,0.002367094,0.004084127,0.001259412,0.00006319644],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7577396,0.0009061147,0.2176944,0.01163703,0.002256792,0.0005361802,0.00002702068,0.00007805694,0.009124804],"genre_scores_gemma":[0.9987186,0.00003475754,0.001077329,0.000103133,0.00001824265,0.000005400404,3.25058e-7,0.000001212241,0.00004095544],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4415295,"threshold_uncertainty_score":0.9955224,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02777259007136487,"score_gpt":0.3161517991049705,"score_spread":0.2883792090336057,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}