{"id":"W7092316905","doi":"","title":"Spectral Analysis of Molecular Features: When Richer Features Do Not Guarantee Better Generalization","year":2025,"lang":"","type":"article","venue":"ArXiv.org","topic":"Machine Learning in Materials Science","field":"Materials Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Alliance de recherche numérique du Canada","keywords":"Kernel (algebra); Property (philosophy); Pattern recognition (psychology); Generalization; Kernel method; Eigenvalues and eigenvectors; Robustness (evolution); Correlation; Representation (politics)","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003913554,0.00146463,0.001081851,0.001195225,0.0004361714,0.001937315,0.000992779,0.001342685,0.002617459],"category_scores_gemma":[0.02062468,0.000300945,0.0008601926,0.0009634679,0.001766144,0.006144597,0.002189124,0.002772885,0.001018026],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007085844,"about_ca_system_score_gemma":0.0007744657,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001096545,"about_ca_topic_score_gemma":0.001232096,"domain_scores_codex":[0.9982592,0.0004996944,0.0001282668,0.0004293801,0.000495165,0.0001882753],"domain_scores_gemma":[0.9923637,0.003519833,0.0007540333,0.00249874,0.0006587856,0.0002049281],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001152065,0.0005858226,0.01985561,0.001115087,0.0004930774,0.0003096882,0.0004511677,0.4466867,0.05121223,0.05813057,0.01062082,0.4093872],"study_design_scores_gemma":[0.00004894963,0.000578544,0.005716377,0.0001331709,0.0001077633,0.0002337968,0.0002091331,0.8445778,0.02777863,0.1157828,0.004768013,0.00006492179],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4139042,0.002676008,0.5682322,0.002775616,0.0001892706,0.0001358148,0.001488785,0.003583178,0.007014883],"genre_scores_gemma":[0.9477047,0.0004399475,0.04882614,0.0003636628,0.00006384012,0.00007841714,0.001231057,0.000341647,0.0009506936],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003913554,"threshold_uncertainty_score":0.02069706,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01178208830966216,"score_gpt":0.2765770003173438,"score_spread":0.2647949120076816,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}