Utilisation des bases de données médico-administratives du Québec pour des études en santé mentale : opportunités, défis méthodologiques et limites – cas de la dépression chez les personnes diabétiques
Notice bibliographique
Résumé
L’utilisation des bases de données médico-administratives pour les études sur des questions de santé mentale est très fréquente compte tenu du grand nombre de personnes représentées dans ces bases de données et aussi du fait qu’elles portent sur plusieurs années. Plusieurs défis, liés par exemple à l’identification des personnes ayant une maladie d’intérêt ou exposées à un facteur de risque, sont à surmonter à travers des études de validation pour garantir une utilisation optimale de ces ressources. Par ailleurs, des limites (absence de certaines informations pertinentes) et la couverture d’une seule partie de la population par le régime public d’assurance médicaments du Québec sont à considérer dans l’interprétation et la généralisation des résultats des recherches à partir de ces bases de données. Dans cet article, nous avons réalisé un survol de l’utilisation des bases de données médico-administratives pour des études épidémiologiques, en utilisant comme exemple le cas spécifique de la dépression. Nous avons en particulier utilisé ces bases de données pour déterminer l’incidence de la dépression parmi les personnes diabétiques du Québec. Cela a nécessité l’utilisation d’un algorithme préalablement validé (dans une autre province) que nous avons modifié pour définir et identifier les cas de dépression dans les bases de données de la Régie de l’assurance maladie du Québec (RAMQ). Nous avons observé une incidence de dépression de 9,47/1000 personnes-années sur un suivi de 8 ans. Enfin, nous avons évalué l’impact de la dépression sur l’adhésion et la persistance aux traitements antidiabétiques ainsi que les facteurs qui affectent l’utilisation des médicaments par ces patients. Nos résultats suggèrent que la dépression a un impact négatif sur l’utilisation des médicaments antidiabétiques et permettent d’identifier des pistes de solution.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,105 | 0,284 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,002 | 0,002 |
| Bibliométrie | 0,007 | 0,013 |
| Études des sciences et des technologies | 0,004 | 0,002 |
| Communication savante | 0,008 | 0,002 |
| Science ouverte | 0,004 | 0,004 |
| Intégrité de la recherche | 0,001 | 0,002 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,004 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».