MétaCan
Menu
Retour à la cohorte
Enregistrement W4408612519 · doi:10.2196/60528

Natural Language Processing and Machine Learning Techniques for Analyzing Conversations About Nutritional Yeasts in the United States and France: Retrospective Social Media Listening Study

2025· article· en· W4408612519 sur OpenAlexvenueno aff
Jean-François Jeanne, Joelle Malaab, Antoine Vanhove, Florian Mourey, Manissa Talmatkadi, Stéphane Schück

Notice bibliographique

RevueJMIR Infodemiology · 2025
Typearticle
Langueen
DomaineSocial Sciences
ThématiqueSocial Media in Health Education
Établissements canadiensnon disponible
Organismes subventionnairesnon disponible
Mots-clésPreprintComputer scienceNatural (archaeology)Social mediaNatural language processingArtificial intelligenceWorld Wide WebHistoryArchaeology

Résumé

récupéré en direct d'OpenAlex

Background: Nutritional yeast, an inactive form of Saccharomyces cerevisiae, has recently become increasingly popular as a food supplement and healthy ingredient, especially among individuals following plant-based diets. It is valued for its health benefits and high content of B vitamins, minerals, and protein. Social media has enabled people to share information and personal experiences at an unprecedented level, further amplifying conversations around health and nutrition. With the rise of social media, data mining techniques like natural language processing and machine learning are increasingly used for analyzing the large amounts of information generated on these platforms. Objective: This study aimed to analyze social media data from the United States and France to identify the most frequently discussed topics among nutritional yeast consumers. The objective was to fill gaps in our understanding of the perceptions, experiences, and usage trends related to nutritional yeast. Methods: This study was retrospective, using social media data geolocated in the United States and France, posted by users discussing nutritional yeast between December 2017 and September 2023. Data cleaning and filtering were done using natural language processing methods and specific algorithms. Biterm topic modeling was applied to identify the most frequently discussed topics. Results: A total of 36,642 posts written by 28,069 users discussing nutritional yeast were identified across 1039 publicly available online sources. This included 34,292 posts from the United States (26,154 users across 994 sources) and 2350 from France (n=1915 users across 45 sources). Twitter was the most commonly used platform in both countries, accounting for 39.6% of posts in the United States (13,587/34,292) and 84.3% in France (1982/2350). In the United States, conversations centered around the role of nutritional yeast role as a vegan nutrient source (n=12,345, 36.0%). Several users highlighted its culinary versatility as a natural seasoning (n=8093, 23.6%) and its health and skin benefits (n=6173, 18.0%). In France, discussions frequently focused on nutritional yeast's use in dietary supplement routines in various forms (n=1177, 50.1%), emphasizing its benefits alongside other supplements such as castor oil, particularly noted for effects on nails and hair (n=928, 39.5%). Conclusions: This social media listening study identified the perceptions and preferences of nutritional yeast users in France and the United States. Researchers and health care professionals can reflect on these findings to investigate the potential health benefits of nutritional yeast for specific groups and its long-term impact on different diets and lifestyles. Marketers may also use this information to create customized strategies that better align with the preferences and needs of each market.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,001
score de la tête « metaresearch » (Gemma)0,004
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: Observationnel
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,184
Score d'incertitude au seuil0,646

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0010,004
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,001
Études des sciences et des technologies0,0010,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,040
Tête enseignante GPT0,422
Écart entre enseignants0,382 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations2
Publié2025
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueJMIR InfodemiologyMême sujetSocial Media in Health EducationTravaux en français237 207