{"id":"W2906631928","doi":"10.1109/ccst.2018.8585560","title":"Toward Developing a Systematic Approach to Generate Benchmark Android Malware Datasets and Classification","year":2018,"lang":"en","type":"article","venue":"","topic":"Advanced Malware Detection Techniques","field":"Computer Science","cited_by":343,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Malware; Random forest; Android malware; Android (operating system); Decision tree; Machine learning; Artificial intelligence; Benchmark (surveying); Mobile malware; Data mining; Precision and recall; Software deployment; Computer security; Operating system","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004543398,0.001808882,0.001047143,0.005830404,0.00113744,0.002262884,0.00387408,0.001318029,0.00138502],"category_scores_gemma":[0.01605215,0.0005641569,0.001272177,0.003225094,0.0005276549,0.003014992,0.002278099,0.002000409,0.001619211],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001300257,"about_ca_system_score_gemma":0.00249513,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005184246,"about_ca_topic_score_gemma":0.008422677,"domain_scores_codex":[0.9959777,0.001033495,0.0005650394,0.0009336506,0.001247146,0.0002430608],"domain_scores_gemma":[0.9908394,0.001918999,0.0006933386,0.002111683,0.004053806,0.0003828135],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005781042,0.004168989,0.05404969,0.00267292,0.0005467741,0.000565721,0.0004253536,0.06745921,0.06380118,0.01545967,0.1203854,0.6698869],"study_design_scores_gemma":[0.0004611732,0.002095704,0.04530012,0.000869846,0.0002804641,0.001249614,0.001262545,0.6360189,0.1412827,0.01864535,0.1521641,0.0003695269],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1909079,0.002198573,0.6816752,0.002835621,0.001041392,0.008185759,0.06890369,0.03375842,0.01049342],"genre_scores_gemma":[0.1454026,0.0006387398,0.7087973,0.0006027856,0.0001332363,0.005176086,0.136946,0.0006737828,0.001629441],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.005830404,"threshold_uncertainty_score":0.02402806,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05446669555926854,"score_gpt":0.2857373318515801,"score_spread":0.2312706362923116,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}