{"id":"W4413145953","doi":"10.1109/cvpr52734.2025.00952","title":"Beyond Clean Training Data: A Versatile and Model-Agnostic Framework for Out-of-Distribution Detection with Contaminated Training Data","year":2025,"lang":"en","type":"article","venue":"","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Training (meteorology); Computer science; Training set; Data modeling; Data mining; Artificial intelligence; Database","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007252488,0.00209879,0.002192288,0.002579082,0.001086059,0.002691557,0.006110875,0.003439743,0.00127822],"category_scores_gemma":[0.02771455,0.001328695,0.001732808,0.001522918,0.002540146,0.004629292,0.005846332,0.006567618,0.001375668],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001342146,"about_ca_system_score_gemma":0.002466019,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006538977,"about_ca_topic_score_gemma":0.009548385,"domain_scores_codex":[0.9952472,0.001456618,0.0002480277,0.00155108,0.001095285,0.0004016798],"domain_scores_gemma":[0.9877643,0.006322106,0.0009158266,0.002855132,0.001685129,0.0004574347],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0006147558,0.0007426935,0.01899663,0.0003217799,0.000357183,0.0004646911,0.0007280275,0.4162086,0.01773609,0.01851341,0.01544444,0.5098718],"study_design_scores_gemma":[0.00001473592,0.00005246353,0.0005960403,0.0000233499,0.00001758212,0.000106254,0.00003506231,0.9826927,0.003371778,0.01147355,0.001594057,0.00002248855],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.009684462,0.0002712755,0.9858549,0.0003695727,0.00004445732,0.00007228408,0.000171266,0.003066274,0.0004655203],"genre_scores_gemma":[0.3599874,0.0003880924,0.6310872,0.001774177,0.000228052,0.0004641121,0.002050445,0.00114763,0.002872881],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.007252488,"threshold_uncertainty_score":0.03835529,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07410539225919884,"score_gpt":0.320659257235589,"score_spread":0.2465538649763901,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}