{"id":"W4366779041","doi":"10.1016/j.neuroimage.2023.120115","title":"Relationship between prediction accuracy and feature importance reliability: An empirical and theoretical study","year":2023,"lang":"en","type":"article","venue":"NeuroImage","topic":"Functional Brain Connectivity Studies","field":"Neuroscience","cited_by":62,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; Mila - Quebec Artificial Intelligence Institute; Montreal Neurological Institute and Hospital","funders":"National Institutes of Health; National Institute on Drug Abuse; National Supercomputing Centre Singapore; National Institute of Mental Health; Medical Research Council; National Medical Research Council; National Research Foundation Singapore; National Research Foundation","keywords":"Feature (linguistics); Reliability (semiconductor); Univariate; Feature selection; Artificial intelligence; Computer science; Pattern recognition (psychology); Predictive modelling; Correlation; Statistics; Machine learning; Data mining; Mathematics; Multivariate statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0428116,0.0009458254,0.001097875,0.002629634,0.0008437025,0.002112353,0.002023419,0.001875139,0.00433782],"category_scores_gemma":[0.3245741,0.0009677265,0.001400072,0.002215075,0.005066797,0.005116357,0.002400568,0.0034715,0.0007814561],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008539147,"about_ca_system_score_gemma":0.0005888023,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002584144,"about_ca_topic_score_gemma":0.001032158,"domain_scores_codex":[0.9811668,0.01026633,0.001019639,0.003981657,0.002978669,0.0005869106],"domain_scores_gemma":[0.327053,0.6117331,0.01931763,0.02800865,0.01252875,0.001358827],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008633356,0.000519002,0.9123701,0.0002272941,0.001021502,0.0002907488,0.00273309,0.01095191,0.00166828,0.01290671,0.00119076,0.05525729],"study_design_scores_gemma":[0.0001131003,0.0008392708,0.79466,0.000173653,0.000546924,0.001666513,0.0009500938,0.1514397,0.002484437,0.04524916,0.001700526,0.0001765502],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9262624,0.002617636,0.06456403,0.001339582,0.00006491971,0.00008678356,0.0003191833,0.000157569,0.004587804],"genre_scores_gemma":[0.9930147,0.000199537,0.006135501,0.0000866159,0.0000687129,0.0000419742,0.0001802511,0.00005519584,0.0002175531],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9571884,"threshold_uncertainty_score":0.2264121,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09338867884370698,"score_gpt":0.3566800502773856,"score_spread":0.2632913714336786,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}