{"id":"W2555801311","doi":"10.5220/0006033800210029","title":"Classification Confusion within Nefclass Caused by Feature Value Skewness in Multi-dimensional Datasets","year":2016,"lang":"en","type":"article","venue":"","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"ca_institutions":"Mount Allison University; University of Guelph","funders":"","keywords":"Confusion; Skewness; Feature (linguistics); Computer science; Value (mathematics); Pattern recognition (psychology); Artificial intelligence; Data mining; Statistics; Machine learning; Mathematics; Psychology; Linguistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008795353,0.000820338,0.001306339,0.002558644,0.001594084,0.002784721,0.00087864,0.001409158,0.0007925195],"category_scores_gemma":[0.03502671,0.0003469685,0.0007921574,0.002172954,0.0009754559,0.002480841,0.001870663,0.0016723,0.0004026086],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001362578,"about_ca_system_score_gemma":0.000932887,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002884839,"about_ca_topic_score_gemma":0.003478178,"domain_scores_codex":[0.9933748,0.001404944,0.0006638764,0.001396199,0.002446644,0.0007136033],"domain_scores_gemma":[0.9637968,0.02248632,0.002623943,0.005396303,0.004964077,0.0007325171],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00489623,0.0009888512,0.2242148,0.0004128743,0.0006026726,0.001749275,0.001527483,0.08456399,0.03781414,0.004248754,0.01401551,0.6249655],"study_design_scores_gemma":[0.00006923456,0.0003332924,0.11953,0.0001690155,0.0002456152,0.001499476,0.0007323413,0.8188685,0.04297662,0.01207068,0.003391253,0.0001138642],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9268475,0.001225343,0.06697638,0.0007305955,0.0004246916,0.00009630832,0.000607513,0.001135642,0.001956024],"genre_scores_gemma":[0.985678,0.0001117162,0.01249548,0.0001812306,0.0000969941,0.00003382656,0.0007050391,0.00007096559,0.0006267958],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.008795353,"threshold_uncertainty_score":0.04651481,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03241016102305022,"score_gpt":0.2910278246572896,"score_spread":0.2586176636342394,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}