Probabilistic bias analysis for exposure misclassification of household income by neighbourhood in a cohort of individuals with colorectal cancer
Notice bibliographique
Résumé
INTRODUCTION: Despite poor agreement, neighbourhood income is used as a proxy for household income, due to a lack of data availability. We quantified misclassification between household and neighbourhood income and demonstrate quantitative bias analysis (QBA) in scenarios where only neighbourhood income is available in assessing income inequalities on colorectal cancer mortality. METHODS: This was a retrospective study of adults with colorectal cancer diagnosed 2006-14 from Statistics Canada's Canadian Census Health and Environment Cohort. Neighbourhood income quintiles from Statistics Canada were used. Census household income quintiles were used to determine bias parameters and confirm results of the QBA. We calculated positive and negative predictive values using multinomial models, adjusting for age, sex and rural residence. Probabilistic QBA was conducted to explore the implication of exposure misclassification when estimating the effect of income on 5-year mortality. RESULTS: We found poor agreement between neighbourhood and household income: positive predictive values ranged from 21% to 37%. The bias-adjusted risk of neighbourhood income on 5-year mortality was similar to the risk of mortality by household income. The bias-adjusted relative risk of the lowest income quintile compared with the highest was 1.42 [95% simulation interval (SI) 1.32-1.53] compared with 1.46 [95% confidence interval (CI) 1.39-1.54] for household income and 1.18 (95% CI 1.12-1.24) for neighbourhood income. CONCLUSION: QBA can be used to estimate adjusted effects of neighbourhood income on mortality which represent household income. The predictive values from our study can be applied to similar cohorts with only neighbourhood income to estimate the effects of household income on cancer mortality.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,090 | 0,194 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,005 |
| Bibliométrie | 0,003 | 0,002 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,002 | 0,002 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,002 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».