{"id":"W4414909223","doi":"10.1007/s44248-025-00067-x","title":"A comparative case study on the performance of global sensitivity analysis methods on digit classification","year":2025,"lang":"en","type":"article","venue":"Discover Data","topic":"Probabilistic and Robust Engineering Design","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Sensitivity (control systems); MNIST database; Key (lock); Deep learning; Digit recognition","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003703075,0.0001108072,0.0003337263,0.0001014353,0.0001224866,0.0001204135,0.0007030395,0.00002660929,0.00001602468],"category_scores_gemma":[0.001481208,0.00005837535,0.00006191424,0.002001027,0.00009956721,0.0002315919,0.0002990106,0.00009795238,0.00002341557],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004877517,"about_ca_system_score_gemma":0.00008010935,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001309499,"about_ca_topic_score_gemma":0.0001303662,"domain_scores_codex":[0.9978663,0.0007157558,0.0003470313,0.0004777857,0.0004891557,0.0001039827],"domain_scores_gemma":[0.9941345,0.003381927,0.0001349625,0.002217926,0.0001047352,0.00002589537],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007363231,0.00424462,0.4011638,0.00003331625,0.004291349,0.0002379968,0.004697958,0.4206906,0.0004760856,0.06463782,0.04437125,0.05441891],"study_design_scores_gemma":[0.0001910346,0.000132291,0.2739715,0.00001733845,0.0003602116,0.000006551414,0.006454333,0.7177824,0.0002143118,0.0003794277,0.0003810753,0.0001095349],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.716646,0.000007223763,0.2806543,0.0001606295,0.0000821681,0.0002213178,0.0004171657,0.000009890315,0.001801314],"genre_scores_gemma":[0.9988631,6.567252e-7,0.0008528132,0.00005479131,0.000009196278,0.000007067154,0.0000281595,0.000001577701,0.0001826328],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2970918,"threshold_uncertainty_score":0.2380478,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3825434191462059,"score_gpt":0.5072527023867561,"score_spread":0.1247092832405503,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}