MétaCan
Menu
Retour à la cohorte
Enregistrement W4408553857 · doi:10.2147/opth.s511233

Comparison of the Aireen System with Telemedicine Evaluation by an Ophthalmologist – A Real-World Study

2025· article· en· W4408553857 sur OpenAlexfundno aff
Martin Šín, Renata Ženíšková, Martin Slíva, Jozefína Vaľková, Barbora Karasová, Jan Tesař, Dana Fillová, Martin Prázný

Notice bibliographique

RevueClinical ophthalmology · 2025
Typearticle
Langueen
DomaineMedicine
ThématiqueRetinal Diseases and Treatments
Établissements canadiensnon disponible
Organismes subventionnairesQueen's University
Mots-clésMedicineTelemedicineOphthalmologyOptometryHealth care

Résumé

récupéré en direct d'OpenAlex

Purpose: This study aimed to compare general ophthalmologists, retina specialists, and Aireen AI screening system with the clinical reference standard of a three-member high-level expert committee for diabetic retinopathy (DR) in the evaluation of fundus images for DR. Patients and Methods: The study was designed as a diagnostic, multicenter, cross-sectional, non-randomized diagnostic study. The cohort included in the clinical investigation consisted of 1274 patients with diabetes mellitus (DM) type I or II. Each patient underwent one-field fundus photography using a non-mydriatic camera to assess findings of DR. One hundred and nineteen subjects (9.3%) were excluded from the clinical investigation based on Aireen system assessment. In the clinical investigation, all images were assessed at three independent levels of evaluation: 1) general ophthalmologists (GO) - without subspecialty training in the retina; 2) retina specialists (RS); and 3) system Aireen. In cases where there may be disagreements amongst groups, the image is referred for assessment by the Diabetic Retinopathy Board (DRB). Results: The overall prevalence of any DR was 31.9% (368 cases out of 1154 DM), according to the DRB. Overall concordance between AI system Aireen and GO and RS assessments in the detection of DR from fundus photography occurred in 734 cases (63.6%). The number of disagreements between Aireen system, GO and RS evaluation occurred in 420 (36.4%) cases. Sensitivity for GO was 87.0% (95% CI: 83.6; 90.4), for RS was 82.9% (95% CI: 79.1; 86.7), and for AI system Aireen was 92.1% (95% CI: 89.3; 94.9). Specificity was 76.5% (95% CI: 73.5; 79.5), 81.2% (95% CI: 78.5; 83.9), and 90.7% (95% CI: 88.7; 92.7) for GO, RS and AI system Aireen, respectively. Conclusion: This real-world study illustrates the potential use of AI system Aireen in screening for DR. It exhibits higher sensitivity and specificity compared to telemedicine evaluation of one field fundus image.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,001
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: Observationnel
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,023
Score d'incertitude au seuil0,454

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0010,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0010,000
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,136
Tête enseignante GPT0,526
Écart entre enseignants0,391 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations3
Publié2025
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueClinical ophthalmologyMême sujetRetinal Diseases and TreatmentsTravaux en français237 207