Multi-variate factor separation of numerical simulations
Notice bibliographique
Résumé
Factor separation is widely used in the analysis of numerical simulations. It allows changes in properties of a system to be attributed to changes in multiple variables associated with that system. There are many possible factor separation methods; here we discuss three previously-proposed methods that have been applied in the field of climate modelling: the linear factor separation, the Stein and Alpert (1993) factor separation, and the Lunt et al (2012) factor separation. We show that, when more than two variables are being considered, none of these three methods possess all four properties of 'uniqueness', 'symmetry', 'completeness', and 'purity'. Here, we extend each of these methods so that they do possess these properties for any number of variables, resulting in three factor separation methods -- the 'linear-sum' , the 'shared-interaction', and the 'scaled-total'. We show that the linear-sum method and the shared-interaction method reduce to be identical in the case of four or fewer variables, and we conjecture that this holds for any number of variables. We present the results of the factor separations in the context of studies that used the previously-proposed methods. This reveals that only the linear-sum/shared-interaction factor separation method possesses a fifth property -- `boundedness', and as such we recommend the use of this method in applications for which these properties are desirable. The work described here is in review in Geoscientific Model Development - see https://gmd.copernicus.org/preprints/gmd-2020-69 .
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,005 | 0,037 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,002 | 0,002 |
| Études des sciences et des technologies | 0,001 | 0,002 |
| Communication savante | 0,002 | 0,003 |
| Science ouverte | 0,002 | 0,002 |
| Intégrité de la recherche | 0,002 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,010 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».