{"id":"W2075878644","doi":"10.1016/j.aca.2011.04.029","title":"Automated optimization and construction of chemometric models based on highly variable raw chromatographic data","year":2011,"lang":"en","type":"article","venue":"Analytica Chimica Acta","topic":"Metabolomics and Mass Spectrometry Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":27,"is_retracted":false,"has_abstract":false,"ca_institutions":"Royal Canadian Mounted Police; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; Alberta Innovates - Technology Futures","keywords":"Feature selection; Data Matrix; Chemometrics; Analyte; Matrix (chemical analysis); Multivariate statistics; Pattern recognition (psychology); Variable (mathematics); Feature (linguistics); Chemistry; Metric (unit); Data mining; Raw data; SIGNAL (programming language); Artificial intelligence; Biological system; Computer science; Chromatography; Statistics; Machine learning; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004861854,0.00212013,0.002131627,0.001761611,0.001089,0.00239732,0.002740956,0.001343512,0.001319994],"category_scores_gemma":[0.01233364,0.001219681,0.002789856,0.002234502,0.0007882854,0.001826324,0.001965472,0.003363314,0.0009990542],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001494086,"about_ca_system_score_gemma":0.003556967,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008163774,"about_ca_topic_score_gemma":0.007675355,"domain_scores_codex":[0.9980247,0.0007434183,0.0001592056,0.0004505776,0.0004733393,0.0001487602],"domain_scores_gemma":[0.9961402,0.002285814,0.0002800912,0.0004017431,0.0007900391,0.0001021254],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0002835087,0.000316626,0.002274519,0.0002159156,0.0002943394,0.00008914882,0.0001832112,0.6494115,0.0108913,0.004012684,0.003200177,0.3288271],"study_design_scores_gemma":[0.000009804082,0.00002336109,0.0002538673,0.000003737096,0.00001550593,0.00001224793,0.000007851692,0.9959213,0.001781601,0.001652415,0.0003092544,0.000009100811],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02008153,0.0001532334,0.9764215,0.0001352254,0.00002100522,0.0001005224,0.0002431681,0.002602504,0.0002413306],"genre_scores_gemma":[0.2381401,0.0002123804,0.7582278,0.0001039385,0.00004040219,0.0005299538,0.001691849,0.0004206597,0.0006328005],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008163774,"threshold_uncertainty_score":0.02571219,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02603327032343781,"score_gpt":0.2355671605187601,"score_spread":0.2095338901953223,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}