Étude de la transcription par des techniques à haut-débit chez le dinoflagellé Lingulodinium polyedrum
Notice bibliographique
Résumé
Les dinoflagellés sont un groupe très varié d’eucaryotes unicellulaires principalement retrouvés en milieu marin où ils ont un rôle écologique majeur dans la production primaire des océans et dans la formation des récifs coralliens. Ils sont aussi responsables de phénomènes néfastes comme les marées rouges et la production de toxines qui contaminent les crustacées et les poissons lorsque les conditions sont propices à leur multiplication rapide. Ces organismes possèdent des caractéristiques moléculaires uniques chez les eucaryotes, particulièrement en ce qui a trait au noyau. Le génome des dinoflagellés s’y retrouve condensé sous forme de cristal liquide stabilisé par des cations métalliques plutôt que sous forme de nucléosomes organisés par des histones. Cette forme condensée persiste tout au long du cycle cellulaire et limite la transcription des gènes à des boucles d’ADN qui se retrouvent à la périphérie des chromosomes. Ces caractéristiques inhabituelles, jumelées à une taille souvent imposante de leur génome, ont grandement limité l’étude des mécanismes moléculaires de base comme la régulation de la transcription. Afin de mieux caractériser ce processus chez ces organismes, le dinoflagellé Lingulodinium polyedrum, qui est étudié majoritairement pour ses multiples rythmes circadiens, a été utilisé. Tout d’abord, le séquençage à haut-débit a été utilisé afin de caractériser le transcriptome complet de l’organisme à quatre temps différents au cours d’une journée. De façon surprenante, ce séquençage a montré que très peu des transcrits varient entre les temps et que ces variations sont de faible amplitude, ce qui contraste fortement avec les résultats obtenus chez d’autres groupes d’organismes. Une inhibition pharmacologique de la transcription a aussi été effectuée et montre que les rythmes de photosynthèse et de bioluminescence continuent d’osciller de façon circadienne en absence de transcription. Ces résultats suggèrent que le modèle traditionnel de génération des rythmes circadiens par des boucles de rétroaction transcription/traduction est probablement absent chez Lingulodinium. La deuxième approche consiste en la caractérisation de deux protéines à domaine cold-shock (CSD), un domaine d’origine bactérienne qui est fortement surreprésenté chez les dinoflagellés et annoté comme potentiel facteur de transcription. Ces deux protéines ont une préférence pour la liaison de l’ADN simple brin versus l’ADN double brin tout en étant ii capable de lier de l’ARN. Par ailleurs, ces liaisons aux acides nucléiques ne sont pas spécifiques à une séquence particulière. L’analyse de leur abondance après un passage prolongé en condition froide n’a pas permis de déceler une augmentation importante de l’abondance des deux protéines et celles-ci sont également incapable de complémenter un quadruple mutant des protéines cold-shock chez E. coli. Ces données suggèrent que les CSDs des dinoflagellés ne sont probablement pas des facteurs de transcription séquence-spécifique et qu’ils ont également une fonction différente des protéines bactériennes. La troisième approche consiste en la réticulation in vivo des protéines interagissant avec la chromatine. Après réticulation, la chromatine a été purifiée et les protéines associées à ceux-ci ont été extraites et identifiées par spectrométrie de masse. Parmi les protéines identifiées, il y a un nombre réduit de protéines de liaison à l’ADN en comparaison avec des données similaires chez les animaux. Des peptides provenant d’une histone H4 ont aussi été identifiés, ce qui consiste en une des premières identifications de ce type de protéine chez les dinoflagellés. Plusieurs protéines de liaison à l’ARN ont été identifiées et pourraient permettre de réguler diverses étapes de la biologie des ARNm et ainsi moduler la traduction. Quelques protéines reliées au contrôle du cycle cellulaire et à la réparation de l’ADN ont aussi été identifiées. Mises ensemble, ces trois approches permettent de suggérer que la régulation de la transcription et de l’abondance des ARNm semblent avoir une importance moindre chez les dinoflagellés que chez les autres eucaryotes.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,001 |
| Bibliométrie | 0,000 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,001 |
| Communication savante | 0,001 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».