Modelos de clasificación de ataques de reflexión DDoS usando técnicas de machine learning
Bibliographic record
Abstract
Los ataques de denegación de servicio distribuidos (DDoS) son una amenaza que afectan a un sistema de computadoras o red causando que un servicio o recurso sea sobrecargado y deje de estar disponible para los usuarios, dado que actualmente el acceso a muchos de estos servicios es fundamental, la temprana identificación de este tipo de ataques es crítica. Por lo anterior, en este trabajo se toma como base un conjunto de datos de ataques DDoS publicados por el Canadian Institute for Cybersecurity (CIC) en el 2019, que contienen inicialmente un conjunto de 80 características relacionadas con el flujo de la información, este conjunto de datos lo utilizaremos para la creación y evaluación de modelos de aprendizaje automático que permitan la correcta clasificación de 2 tipos de ataque de denegación de servicios , aquellos que hacen uso del protocolo SSDP (Simple ServiceDiscovery Protocol) y del protocolo de resolución de Microsoft SQL server (MSSQL). Los datos estuvieron divididos en 3 conjuntos de datos, el primero con registros de ataques MSSQL y datos benignos, el segundo con registros de ataques SSDP y registros benignos, mientras que el ´último fue resultado de la combinación de los anteriores. Los datos fueron procesados con el objetivo de obtener una muestra balanceada y con características relevantes para la construcción de distintos modelos de clasificación que permitiera la detección eficiente de los ataques. Los algoritmos utilizados para la construcción de estos modelos fueron, árbol de decisión, maquinas de soporte vectorial, redes neuronales y regresión logística. Donde quedó demostrada la capacidad discriminatoria del modelo de árbol de decisiones para clasificar los datos de manera más precisa para el conjunto de datos en el que se estudiaban ambos tipos de ataques, por otro lado, se pudo comprobar que para la comparativa entre, cada ataque contra solo peticiones benignas, todos los modelos se desempeñaban de una manera destacable, en gran parte por las diferencias notorias identificadas en las características de los registros. Los modelos dejan así en evidencia su posible aplicación para identificar ataques de reflexión DDoS basados en SSDP y MSSQL.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame distilled prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. Learned from the 10,348 direct Codex labels and 10,348 direct Gemma labels. Candidate is the union of thresholded teacher heads; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels or direct frontier model labels.
Codex and Gemma teacher scores by category
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.002 | 0.002 |
| Meta-epidemiology (narrow) | 0.002 | 0.002 |
| Meta-epidemiology (broad) | 0.002 | 0.001 |
| Bibliometrics | 0.001 | 0.001 |
| Science and technology studies | 0.001 | 0.000 |
| Scholarly communication | 0.001 | 0.000 |
| Open science | 0.002 | 0.001 |
| Research integrity | 0.003 | 0.005 |
| Insufficient payload (model declined to judge) | 0.001 | 0.004 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; both teacher heads agree on what is shown here.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".