{"id":"W3095042565","doi":"10.1007/978-3-030-63128-4_52","title":"Binary Text Representation for Feature Selection","year":2020,"lang":"en","type":"book-chapter","venue":"Advances in intelligent systems and computing","topic":"Text and Document Classification Technologies","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Redundancy (engineering); Feature selection; Computer science; Binary number; Relevance (law); Minimum redundancy feature selection; Mutual information; Selection (genetic algorithm); Representation (politics); Feature (linguistics); Filter (signal processing); Artificial intelligence; Binary classification; Data mining; Machine learning; Pattern recognition (psychology); Mathematics; Support vector machine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000424477,0.0007712576,0.0006740219,0.001585634,0.0003652798,0.001137186,0.001085905,0.0006865708,0.01628674],"category_scores_gemma":[0.001897613,0.000181348,0.0005145856,0.003024111,0.0002133629,0.001323582,0.0006157822,0.0008268676,0.01081627],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002822592,"about_ca_system_score_gemma":0.0003783532,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009593528,"about_ca_topic_score_gemma":0.0008478889,"domain_scores_codex":[0.999588,0.00009052389,0.00004373144,0.00009098277,0.000149846,0.00003695168],"domain_scores_gemma":[0.9994868,0.0001725957,0.00004374277,0.0001086237,0.0001711288,0.00001709428],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002258399,0.00007981715,0.0001486517,0.0002823437,0.00002579535,0.00007369008,0.00003459577,0.005466037,0.02483721,0.01450873,0.05546206,0.8988553],"study_design_scores_gemma":[0.0001067014,0.000335128,0.002241496,0.0002441132,0.0001420074,0.001060339,0.0001144902,0.6535805,0.07962575,0.06723884,0.1951979,0.000112815],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.006155416,0.002141677,0.9740714,0.0004067527,0.0007008559,0.0001208101,0.002745402,0.004962872,0.008694733],"genre_scores_gemma":[0.13514,0.002683079,0.8021126,0.0005015498,0.0007519474,0.0006638831,0.01578329,0.0008074746,0.0415562],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01628674,"threshold_uncertainty_score":0.05448455,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03133614524783514,"score_gpt":0.2986975766940242,"score_spread":0.2673614314461891,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}