{"id":"W4291288982","doi":"10.1101/2022.08.08.503167","title":"Relationship Between Prediction Accuracy and Feature Importance Reliability: an Empirical and Theoretical Study","year":2022,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Functional Brain Connectivity Studies","field":"Neuroscience","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; Mila - Quebec Artificial Intelligence Institute; Montreal Neurological Institute and Hospital","funders":"National Institutes of Health; National Supercomputing Centre Singapore; Medical Research Council; National Medical Research Council; National Research Foundation Singapore; National Research Foundation","keywords":"Feature (linguistics); Reliability (semiconductor); Univariate; Feature selection; Computer science; Artificial intelligence; Predictive modelling; Pattern recognition (psychology); Statistics; Correlation; Machine learning; Data mining; Mathematics; Multivariate statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0328951,0.000725798,0.0008439594,0.002339461,0.0006852869,0.001789985,0.001747181,0.001580966,0.00476521],"category_scores_gemma":[0.2915435,0.0007984035,0.001141848,0.001699251,0.004076569,0.003432872,0.00180214,0.002700478,0.0007229766],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006625977,"about_ca_system_score_gemma":0.000441145,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002245939,"about_ca_topic_score_gemma":0.0008352061,"domain_scores_codex":[0.9859325,0.008268283,0.0007490474,0.00255898,0.002042386,0.0004489261],"domain_scores_gemma":[0.3608693,0.5836474,0.01865227,0.02426291,0.01103627,0.001531875],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009187596,0.0005450426,0.9406583,0.000169104,0.000768568,0.0003041809,0.002226936,0.01105831,0.001527279,0.008844885,0.001054133,0.03192454],"study_design_scores_gemma":[0.0001085219,0.0007960612,0.7856163,0.000124262,0.0004176974,0.001335157,0.0008991501,0.1735246,0.002182547,0.03388295,0.0009733337,0.0001393876],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9712846,0.0007226517,0.02500493,0.000458533,0.00003071804,0.00004555801,0.0001857731,0.00007915712,0.002188106],"genre_scores_gemma":[0.9972585,0.00005390662,0.002372453,0.00003115131,0.00002582081,0.00002013698,0.0001010201,0.00002339645,0.0001135588],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9671049,"threshold_uncertainty_score":0.173968,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04721673728638489,"score_gpt":0.295984258898174,"score_spread":0.2487675216117891,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}