In Vivo Laparoscopic Image De-Smoking Dataset, Evaluation, and Beyond
Notice bibliographique
Résumé
The development of effective algorithms for removing surgical smoke in laparoscopic surgery has been hindered by the absence of a paired dataset containing real smoky and smoke-free surgical scenes. As a result, existing de-smoking methods have been primarily based on synthetic datasets and non-reference image enhancement metrics, which fail to fully capture the complexity of in vivo surgical scenes. To address this gap, we present a novel paired dataset derived from laparoscopic surgical recordings by identifying video sequences with relatively stationary scenes where smoke emerges. Our approach includes a robust motion-tracking technique that compensates for involuntary patient movements, ensuring reliable pairing of smoky images and their corresponding smoke-free ground truths. From 132 laparoscopic prostatectomy recordings, we curated 41 video sequences, resulting in a dataset of 2000 smoky-to-smoke-free image pairs. From 45 cholecystectomy recordings, we extracted 68 video sequences, resulting in an additional dataset of 1000 image pairs. Using this unique dataset, we evaluated a representative selection of current de-smoking methods, confirming their effectiveness while also highlighting their limitations. Furthermore, we critically revisited the commonly used atmospheric scattering model, atmospheric colour assumptions, and the dark channel prior. Our analysis demonstrated that the traditional atmospheric scattering model with "gray smoke" assumption introduces significant residual errors in the green and blue channels, while the dark channel prior maintains a strong correlation with smoke intensity. These observations suggest that, while less effective for direct smoke separation, the dark channel prior has potential to serve as a useful attention map for deep learning-based de-smoking approaches.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».