WHF‐YOLOv11: Traffic Cone Detection Algorithm in Complex Scenes Based on Wavelet Convolution and Hierarchical Feature Attention
Notice bibliographique
Résumé
Aiming to address the issues of missed detection and low accuracy in detecting small, dense traffic cones in complex traffic scenarios, this study proposes an improved traffic small target detection method based on YOLOv11, referred to as WHF‐YOLOv11. In terms of network structure, large receptive field wavelet convolution is introduced into the YOLOv11 network (WTConv). By decomposing and reconstructing the image at different scales, the model can capture the local and global features of the image more accurately, so as to effectively extract the key details such as texture and edge. At the level of feature map extraction, the hierarchical multiscale feature fusion network (HiFuse) was introduced into the neck network. By utilizing a three‐branch HiFuse, the local perception capabilities of CNNs and the global modeling strengths of transformers were combined to enhance the image classification accuracy. In terms of loss function, Focaler‐IoU is used as the bounding box loss function to improve the detection ability of small target difficult cases. The experimental results show that for the traffic cone dataset obtained on the Roboflow platform, compared to the benchmark model YOLOv11 n, the improved model improves the accuracy rate P and recall rate R by 2.8% and 1.7%, respectively, and mAP50 and mAP50∼95 by 1.6% and 3.3%, which verifies the effectiveness of the model and provides technical support for the intelligent detection of small targets in traffic scenes.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,001 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».