MétaCan
Menu
Retour à la cohorte
Enregistrement W4415071976 · doi:10.1016/j.ijmedinf.2025.106127

Validity and transferability of Model for ASsessing the value of Artificial Intelligence (MAS-AI)

2025· article· en· W4415071976 sur OpenAlexafffundabout
Iben Fasterholdt, Linda Hansen, James M. Bowen, Anne Gerdes, Kristian Kidholm, Tudor Mihai Haja, Francesco Calabrò, Rossana Cecchi, Aleksandra Stanimirovic, Troy Francis, Valeria E. Rac, Benjamin Schnack Rasmussen

Notice bibliographique

RevueInternational Journal of Medical Informatics · 2025
Typearticle
Langueen
DomaineMedicine
ThématiqueArtificial Intelligence in Healthcare and Education
Établissements canadiensUniversity Health NetworkTed Rogers Centre for Heart Research
Organismes subventionnairesOdense UniversitetshospitalSyddansk UniversitetUniversity Health Network
Mots-clésTransferabilityData collectionValue (mathematics)Measure (data warehouse)External validity

Résumé

récupéré en direct d'OpenAlex

OBJECTIVES: In 2022, a multidisciplinary group of experts and patients published a Model for ASsessing the value of AI (MAS-AI) in medical imaging. MAS-AI is a critical tool for decision-makers, enabling them to make informed choices on the prioritization of AI solutions. The objective of this study was to assess the face validity and transferability of MAS-AI by investigating workshop participants' perceptions in Denmark, Italy, and Canada regarding the importance of its content. METHODS: A Delphi process was conducted, including inputs from four workshops with a sample of decision makers from hospitals or the healthcare sector, patient partners and various researchers and experts. The participants were asked to rate the importance of each of the domains and subtopics in MAS-AI on a 0-3 Likert scale. RESULTS: A total of 95 participants from three countries participated. The face validity of all MAS-AI domains was confirmed by Denmark, Canada, and Italy, with over 70 percent of the respondents in the first round rating the domains as moderately or highly important. Overall, the five process factors were considered moderately or highly important by between 93 percent and 87 percent of the respondents. All the individual subtopics under each domain were rated above the 70 percent cut-off, except five subtopics for Italy. CONCLUSIONS: The study confirmed the validity of the MAS-AI domains in Denmark, Canada, and Italy. Several improvements in study design and data collection were identified. In the future, analyzing participants to understand which items were rated as important by whom could provide valuable insights.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,003
score de la tête « metaresearch » (Gemma)0,003
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Simulation ou modélisation · Signal consensuel: aucune
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,904
Score d'incertitude au seuil0,325

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0030,003
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,235
Tête enseignante GPT0,514
Écart entre enseignants0,279 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeSimulation ou modélisation
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations0
Publié2025
Routes d'admission3
Résumé présentoui

Explorer davantage

Même revueInternational Journal of Medical InformaticsMême sujetArtificial Intelligence in Healthcare and EducationTravaux en français237 207