Infrastructure canadienne de donnnées géospatiales, description de l'architecture
Notice bibliographique
Résumé
L'Infrastructure canadienne de données géospatiales (ICDG) est un ensemble distribué de données et regroupe des services et des applications permettant le partage et l'utilisation d'information à référence géospatiale. L'ICDG est élaborée par le programme GéoConnexions. Une introduction complète à l'ICDG et à ses divers aspects est présentée dans le document ICDG Vision cible. L'ICDG est une infrastructure de technologie de l'information ouverte qui se fonde sur des spécifications disponibles au public. Grâce à sa conception, l'architecture permet la mise en oeuvre de systèmes pour appuyer des fournisseurs de services et de données ainsi que des développeurs d'applications, à l'aide de composantes interopérables et réutilisables. C'est en précisant les interfaces de ces services que l'on peut largement atteindre ce but. Ces spécifications sont inspirées de la série 19100 de l'Organisation internationale de normalisation (ISO) concernant les normes abstraites en matière d'information géographique et des spécifications connexes pour la mise en oeuvre qu'établit actuellement Open GIS Consortium (OGC). Le présent document de description de l'architecture fait partie d'un groupe de trois documents évolutifs décrivant l'ICDG : 1. Vision cible de l'ICDG, 2. Description de l'architecture de l'ICDG, 3. Plan de mise en oeuvre de l'ICDG.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,005 | 0,007 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,002 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,005 | 0,007 |
| Études des sciences et des technologies | 0,003 | 0,002 |
| Communication savante | 0,015 | 0,008 |
| Science ouverte | 0,003 | 0,006 |
| Intégrité de la recherche | 0,003 | 0,004 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,017 | 0,011 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».