Using YOLO Few_Shot Learning for Labeling Inflammatory Bowel Diseases
Notice bibliographique
Résumé
Inflammatory bowel disease (IBD) is a chronic deteriorating condition that affects millions of people all over the world. The application of machine learning to IBD has the potential to arrive at effective treatment response, accurate diagnosis and improving patient survival rates. Inflammatory Bowel Disease (IBD) includes Crohn's disease and ulcerative colitis, two chronic conditions causing inflammation of the digestive tract. Crohn's disease can affect any part of the GI tract with deep, patchy inflammation, while ulcerative colitis is limited to the large intestine's inner lining, causing continuous inflammation. A third, less common type is indeterminate colitis, where features of both are present. Machine learning models can automate the review of images and biopsy slides taken from IBD procedures, identify novel biomarkers, and create predictive models for patient outcomes, helping clinicians tailor therapies and interventions for better patient care. Indeed, machine learning algorithms perform poorly when applied to medical applications due to unavailability of large annotated samples. However, learning algorithms like YOLO is inherently better at learning from small sample sizes than other machine learning models. This study adopt a variant of the YOLO model (originally pre-trained using the COCO dataset) that has been fine-tuned using the Hyper-Kvasir IBD dataset. Moreover, the fine-tuned model is used then to classify the GI conditions using a Triplet-Loss Siamese Neural Network (SNN). The integration between the YOLO model and the SNN has been simplified using the RoboFlow environment to assist expert to verify the YOLO annotations that will involve not only the ground truth but also cases that may be mistakenly classified as one of the model classes. Our fine tuning and SNN model shows much better classification of IBD region of interest even for those having a variable shape like ulcerative colitis.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,002 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,001 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,002 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,002 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».