{"id":"W1997967533","doi":"10.1021/pr900665y","title":"SherLoc2: A High-Accuracy Hybrid Method for Predicting Subcellular Localization of Proteins","year":2009,"lang":"en","type":"article","venue":"Journal of Proteome Research","topic":"Machine Learning in Bioinformatics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":143,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University","funders":"","keywords":"Computer science; Gene ontology; Subcellular localization; Data mining; Protein sequencing; Sequence (biology); Protein subcellular localization prediction; Feature (linguistics); Computational biology; Artificial intelligence; Gene; Biology; Peptide sequence; Genetics; Gene expression","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002408064,0.002118599,0.001390887,0.004393671,0.0007778258,0.001546609,0.002495031,0.002176379,0.00579163],"category_scores_gemma":[0.004726007,0.0005588779,0.001316997,0.00229676,0.0003715655,0.001565672,0.001862663,0.001303414,0.005239043],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006039073,"about_ca_system_score_gemma":0.0008350326,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002495441,"about_ca_topic_score_gemma":0.005727827,"domain_scores_codex":[0.998449,0.0003438007,0.00009751895,0.0003442687,0.0006328009,0.0001325832],"domain_scores_gemma":[0.9972417,0.001255692,0.0002305717,0.0003659657,0.0007549455,0.0001511071],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001599717,0.0003657543,0.01554571,0.0006864005,0.0009307648,0.0005424052,0.0001870524,0.07248852,0.04658982,0.002855494,0.0583665,0.7998419],"study_design_scores_gemma":[0.00009680627,0.0001314048,0.004327288,0.00003093914,0.0001029982,0.0005783569,0.00005199254,0.9608335,0.02132663,0.00326536,0.00914793,0.0001067742],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.05548036,0.001288009,0.8882227,0.0002218326,0.0001941763,0.0001524782,0.003649223,0.04792008,0.002871147],"genre_scores_gemma":[0.2589467,0.000427134,0.7180033,0.0003097938,0.0001391295,0.0003949656,0.01040312,0.001924049,0.009451765],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.00579163,"threshold_uncertainty_score":0.01937497,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02805623053856246,"score_gpt":0.3845717248430646,"score_spread":0.3565154943045022,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}