{"id":"W3136739538","doi":"10.1021/acs.analchem.1c00310","title":"MANTI: Automated Annotation of Protein N-Termini for Rapid Interpretation of N-Terminome Data Sets","year":2021,"lang":"en","type":"article","venue":"Analytical Chemistry","topic":"Peptidase Inhibition and Analysis","field":"Medicine","cited_by":17,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"Canadian Institutes of Health Research; Aarhus Universitets Forskningsfond; H2020 European Research Council; Novo Nordisk Fonden; Deutsche Forschungsgemeinschaft","keywords":"Computational biology; Annotation; Proteome; Chemistry; Computer science; Perl; Identification (biology); Data mining; Biochemistry; Programming language; Biology; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001337669,0.00009136982,0.0003277929,0.00004014781,0.00001526396,0.000007976522,0.00009175634,0.00008729141,0.0003954589],"category_scores_gemma":[0.0005349936,0.00008777688,0.000135213,0.000230014,0.00007842647,0.00007498542,0.00005605052,0.00006919177,0.00000364383],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00001872006,"about_ca_system_score_gemma":0.0001314565,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000002623656,"about_ca_topic_score_gemma":6.025106e-7,"domain_scores_codex":[0.9989865,0.00001537806,0.0004401583,0.0002581493,0.0001884513,0.0001114011],"domain_scores_gemma":[0.998915,0.00006019618,0.0001598752,0.0004627951,0.0003254087,0.0000767598],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.000194176,0.0004021284,0.0003964445,0.002238343,0.0002667228,0.00007603489,0.00006255327,0.000006205854,0.9907026,0.00004802296,0.001378168,0.004228604],"study_design_scores_gemma":[0.000832562,0.00004377746,0.000690214,0.0006802224,0.0002787615,0.00003690247,0.0001150719,0.3468566,0.6501829,0.00006530788,0.0001359751,0.0000816725],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9946962,0.00004761198,0.001880982,0.0005564118,0.000006180147,0.0001418362,0.0002747777,0.00005309462,0.00234291],"genre_scores_gemma":[0.994496,0.000003627882,0.001713865,0.00007719519,0.00003527033,0.000007956799,0.002694593,0.000009344363,0.00096211],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3468504,"threshold_uncertainty_score":0.4329998,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04016909283259738,"score_gpt":0.3518800884958349,"score_spread":0.3117109956632375,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}