{"id":"W7127395196","doi":"10.1109/ccece64018.2025.11364449","title":"MetJam: Metamorphic Testing for Data Synthesize and Quality Assurance of an ML-based Jamming (DOS) Detector in 5G","year":2025,"lang":"","type":"article","venue":"","topic":"Adversarial Robustness in Machine Learning","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Blackberry (Canada); University of Ottawa","funders":"","keywords":"Correctness; Process (computing); Domain (mathematical analysis); Detector; sort; Subject-matter expert; Quality assurance; Denial-of-service attack; Quality (philosophy)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.009938478,0.0005278879,0.001225532,0.0005351062,0.0003972043,0.0003343256,0.003514486,0.0002514876,0.00002387974],"category_scores_gemma":[0.03482684,0.0005429839,0.0001070211,0.002166967,0.0003254856,0.001840062,0.001396365,0.000629854,0.000001180114],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001082759,"about_ca_system_score_gemma":0.0008902105,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003534975,"about_ca_topic_score_gemma":0.001550946,"domain_scores_codex":[0.9933211,0.00159632,0.001678256,0.002036418,0.0005740958,0.00079384],"domain_scores_gemma":[0.9779573,0.01750757,0.0008961204,0.003076658,0.000391045,0.0001713104],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003745413,0.00041749,0.06580533,0.00276358,0.0001965748,0.00001943913,0.0005302608,0.08337973,0.01851581,0.009836648,0.00001266037,0.8181479],"study_design_scores_gemma":[0.001808852,0.0001962374,0.02980953,0.0007455879,0.0001358465,0.000001794943,0.0001453458,0.9562194,0.009558137,0.0007779782,0.00009639316,0.0005049098],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1471251,0.0005297498,0.8497611,0.0007046491,0.0005022747,0.0008638855,0.00004087093,0.0001122413,0.0003601542],"genre_scores_gemma":[0.582778,0.00000317148,0.4169179,0.000142695,0.00004568346,0.00002357289,0.000005626135,0.00002008152,0.00006327211],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.8728396,"threshold_uncertainty_score":0.9997022,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1179929271528875,"score_gpt":0.3738083530836773,"score_spread":0.2558154259307898,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}