{"id":"W4414122916","doi":"10.1175/aies-d-24-0114.1","title":"Evaluating the Robustness of PCMCI+ for Causal Discovery of Flood Drivers","year":2025,"lang":"en","type":"article","venue":"Artificial Intelligence for the Earth Systems","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"HORIZON EUROPE European Research Council; Helmholtz Artificial Intelligence Cooperation Unit","keywords":"Robustness (evolution); Causal inference; Spurious relationship; Causal structure; Flood myth; Causal model; Conditional independence; Multivariate statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001014572,0.00008580164,0.000161907,0.00005745052,0.0003186834,0.00009390244,0.0007877281,0.00004386951,0.000001180274],"category_scores_gemma":[0.0001236408,0.00005287354,0.0001414198,0.0004239729,0.0001306929,0.0001487474,0.00008757129,0.00005852825,0.000001281587],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00001095369,"about_ca_system_score_gemma":0.00008448269,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001446567,"about_ca_topic_score_gemma":0.00004639169,"domain_scores_codex":[0.9989449,0.00005365012,0.0004890375,0.0002013471,0.0001584572,0.000152623],"domain_scores_gemma":[0.9979849,0.0009394643,0.0002499566,0.0005449937,0.0002673191,0.00001331318],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002679045,0.00004277377,0.0000208797,0.00008457498,0.00005012431,2.387065e-8,0.000319776,0.0948929,0.007701211,0.8346606,0.0001281451,0.06207213],"study_design_scores_gemma":[0.00002223877,0.0001780936,0.00002556443,0.0000556811,0.00002918168,8.682148e-7,0.0007882661,0.8208959,0.1663732,0.01091857,0.0006533106,0.00005914152],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01752963,0.0001341227,0.9795862,0.0004873512,0.0007029528,0.001434632,0.00002139395,0.00003933322,0.00006436812],"genre_scores_gemma":[0.9913467,0.000008881246,0.007513598,0.00001647931,0.00008910358,0.0004601506,0.000001283261,0.000005095792,0.0005586966],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9738171,"threshold_uncertainty_score":0.2451087,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1047690277692359,"score_gpt":0.3758328471165397,"score_spread":0.2710638193473039,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}