{"id":"W4415682779","doi":"10.18280/mmep.120905","title":"XGRL-TCP: An Explainable Graph-Based Reinforcement Learning Framework for Test Case Prioritization in CI","year":2025,"lang":"","type":"article","venue":"Mathematical Modelling and Engineering Problems","topic":"Explainable Artificial Intelligence (XAI)","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Test (biology); Prioritization; Reinforcement learning; Key (lock); Action (physics); Matching (statistics)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.001605348,0.000500746,0.0005901346,0.0006208839,0.0005027521,0.0007507237,0.0004278982,0.0003644126,0.00001286343],"category_scores_gemma":[0.0009490359,0.0005553592,0.0001156727,0.001228097,0.0000813014,0.0006379322,0.0001484797,0.0007053349,0.000008383943],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000169113,"about_ca_system_score_gemma":0.0001248443,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00009493867,"about_ca_topic_score_gemma":0.000007224098,"domain_scores_codex":[0.99653,0.00006119368,0.001169879,0.0008944994,0.0003082809,0.001036168],"domain_scores_gemma":[0.9971155,0.001634675,0.0001559401,0.0006073547,0.0002275202,0.0002590049],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001059431,0.0001929691,0.00002076088,0.002555087,0.00001428736,0.0000499981,0.002096838,0.7285076,0.00009061546,0.2646321,0.000002396587,0.001826807],"study_design_scores_gemma":[0.0002626923,0.000326515,5.040258e-7,0.002896287,0.00003388506,0.00002806413,0.0003002292,0.8107826,0.001287235,0.1835138,0.0001239057,0.0004443123],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.009417181,0.0005395075,0.9877228,0.0003454935,0.0002260003,0.001323617,0.000002344625,0.0002712946,0.0001517728],"genre_scores_gemma":[0.7065755,0.00008409858,0.2927189,0.0000464629,0.00004453768,0.0003088933,0.000005971107,0.00004285224,0.0001728504],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.6971583,"threshold_uncertainty_score":0.9996898,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03517078771299631,"score_gpt":0.2717951182795331,"score_spread":0.2366243305665368,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}