Notice bibliographique
Résumé
Avant-proposPour la deuxième fois notre revue consacre un volume monographique aux recherches géolinguistiques dans l'espace roman d'outre-Atlantique.Le premier, intitulé La géolinguistique en Amérique latine, publié en 2002, réunissait douze contributions de quelques uns des meilleurs spécialistes de ses différents domaines, du Chili au Québec, hispanophones, lusophones et francophones.Le développement important des recherches dans plusieurs pays du continent, nous a encouragés à poursuivre l'objectif qui était le nôtre de faire mieux connaître ces dernières auprès de la communauté des dialectologues européens en dédiant ce quinzième numéro de Géolinguistique au Brésil et, en particulier, à ses chantiers atlantographiques, achevés ou en cours de réalisation.Même si l'intérêt pour la situation linguistique du Brésil se manifeste dès la première moitié du xix e siècle, comme le rappelle l'article de J. Mota, qui ouvre ce volume, les recherches géolinguistiques dans le pays ne démarrent véritablement qu'à partir des années 1950, avec les travaux de A. Nascentes.À cette date, l'Europe romane, a déjà un demi-siècle d'expérience dans ce domaine : à la suite de l'Atlas linguistique de la France (ALF) de J. Gilliéron et E. Edmont qui marque le départ de la géolinguistique moderne, plusieurs pays avaient déjà réalisé des atlas nationaux et commencé à publier des atlas régionaux.Les dialectologues brésiliens auront opté pour le cheminement inverse, en commençant par des atlas régionaux, même si l'adjectif ne correspond pas tout à fait au même terme employé en France, par exemple, pour les atlas du projet ALF-Régions du CNRS, couvrant le plus souvent des territoires de plusieurs départements.Ceux du Brésil intéressent généralement, le territoire d'un État -le Brésil est une république fédérale -dont l'étendue peut être plus grande que celle de la France entière !D'où les difficultés considérables auxquelles les différents chantiers de géolinguistique ont dû faire face : rien d'étonnant, par conséquent, que le projet d'un atlas national ait été remis à plus tard.Nous constatons cependant que ce « plus tard » ne s'est pas fait attendre longtemps car, avant la fin du siècle, exactement en 1996, l'Atlas linguistique du Brésil (ALiB) était lancé et que ses deux premiers volumes, ont vu le jour en 2014, dix huit ans seulement après le lancement.La nouvelle
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,010 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,002 | 0,002 |
| Études des sciences et des technologies | 0,004 | 0,002 |
| Communication savante | 0,009 | 0,007 |
| Science ouverte | 0,002 | 0,004 |
| Intégrité de la recherche | 0,003 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,183 | 0,100 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».