Taking the Middle Road: Reflections on Mixed Methodology within the Digital Humanities
Notice bibliographique
Résumé
In the rapidly evolving field of digital humanities, methodological considerations, especially the interplay between “distant reading” and “close reading,” play a prominent role. This paper, presented against the backdrop of these two critical approaches, undertakes a comprehensive exploration of reflections on mixed methodology that have emerged within the field, emphasizing calls for a blending of distant reading and close reading. Starting with an evaluation of the origins of such terminology in the field, the paper elucidates the ongoing debates surrounding the tensions between these two reading paradigms. Highlighting the multifaceted terrain of these debates, the paper enumerates the terminology on such methodology that has been explored and expanded by digital humanists. Furthermore, through analyzing a number of methodological reflections, the affordances and the practical implications of a mixed methodology in computational literary studies are discussed. Starting from bringing distant reading and close reading together in the research process, the focus shifts from a mere juxtaposition of these two reading modalities to a broader contemplation of the objects of study in digital humanities projects. Then, moving from scale to scope, collaboration emerges as an integral element in the discourse. Recognizing both its opportunities and inherent challenges, the paper examines the need for collaboration between scholars from different disciplines and explores the emergence of mixed methods in a collaborative context. The need to employ both distant reading and close reading in such context is formulated as a way to appeal to more traditional humanists. In its conclusion, the article heralds the significance of “alien reading,” emphasizing the need for understanding machine reading as a distinct, albeit integral, component in the digital humanities’ tapestry, especially in the age of AI and LLMs. Dans le domaine en rapide évolution des humanités numériques, les considérations méthodologiques, en particulier l’interaction entre le « distant reading » et le « close reading », occupent une place prépondérante. Cet article, présenté dans le contexte de ces deux approches critiques, propose une exploration approfondie des réflexions sur la méthodologie mixte qui ont émergé dans ce domaine, en mettant l’accent sur les appels à combiner la lecture de loine et la lecture de près. En commençant par une évaluation des origines de cette terminologie dans le domaine, l’article éclaire les débats en cours autour des tensions entre ces deux paradigmes de lecture. Soulignant la diversité de ces débats, l'article répertorie les terminologies liées à ces méthodologies, explorées et développées par les humanistes numériques. De plus, à travers l’analyse de plusieurs réflexions méthodologiques, les avantages et les implications pratiques d’une méthodologie mixte en études littéraires computationnelles sont discutés. En partant du rapprochement entre lecture de loine et lecture de près dans le processus de recherche, l’attention passe d’une simple juxtaposition de ces deux modalités de lecture à une réflexion plus large sur les objets d’étude des projets en humanités numériques. Ensuite, en évoluant de l’échelle à l’étendue, la collaboration apparaît comme un élément central dans le discours. Reconnaissant à la fois ses opportunités et ses défis inhérents, l’article examine la nécessité d’une collaboration entre chercheurs de disciplines différentes et explore l’émergence de méthodes mixtes dans un contexte collaboratif. Le besoin d’employer à la fois la lecture distante et la lecture rapprochée dans ce contexte est formulé comme un moyen de s’adresser aux humanistes plus traditionnels. En conclusion, l’article souligne l’importance de la « alien reading » (ou « lecture étrangère »), en mettant en avant la nécessité de comprendre la lecture par la machine comme une composante distincte mais intégrale dans le paysage des humanités numériques, notamment à l’ère de l’IA et des modèles de langage étendus (LLM).
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,002 | 0,002 |
| Communication savante | 0,007 | 0,002 |
| Science ouverte | 0,001 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».