{"id":"W7132447067","doi":"","title":"Performance estimation bias in class imbalance with minority subconcepts","year":2023,"lang":"en","type":"article","venue":"NPARC","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Weighting; Class (philosophy); Variety (cybernetics); Estimation; Variance (accounting); Ensemble learning","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003916894,0.000114715,0.000130621,0.0001878086,0.00006679603,0.0000761167,0.0007164046,0.00005527786,0.00001042853],"category_scores_gemma":[0.00006028571,0.0001024821,0.0000156981,0.001288192,0.00006582527,0.0008330233,0.0001234019,0.0001462036,0.000169099],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00008021858,"about_ca_system_score_gemma":0.00007112236,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001336377,"about_ca_topic_score_gemma":0.00001421631,"domain_scores_codex":[0.9988084,0.00004885902,0.0002016306,0.0003590936,0.0002966248,0.0002853635],"domain_scores_gemma":[0.9990386,0.00007366958,0.00009460715,0.0006839318,0.00006220243,0.00004703439],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000530271,0.0001789093,0.4736104,0.0001964515,0.00001485901,0.00006871184,0.001259496,0.00161718,0.03445612,0.1386626,0.02915735,0.3207249],"study_design_scores_gemma":[0.0002354233,0.00004938207,0.3678991,0.00003963963,0.000001071746,0.000007096211,0.00001008414,0.6169631,0.01100075,0.002250397,0.001382749,0.0001611387],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7653902,0.000008446401,0.2042333,0.00259975,0.0001594999,0.0004094727,0.00001587346,0.001892914,0.02529056],"genre_scores_gemma":[0.9240672,0.00002767923,0.0753452,0.0001140294,0.00001842696,0.00008461867,0.00003623236,0.000006556579,0.0003000684],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.615346,"threshold_uncertainty_score":0.4179099,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03773536412493794,"score_gpt":0.2752874115409746,"score_spread":0.2375520474160367,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}