Framework for the comparison of <i>a priori</i> and <i>a posteriori</i> error variance estimation and tuning schemes
Notice bibliographique
Résumé
Abstract The performance of an assimilation system is strongly dependent on the quality of the error statistics used. A number of error statistics estimation and tuning methods have previously been developed to better assess and determine these statistics. Many of these are a posteriori methods which make use of quantities calculated during the assimilation procedure, while other a priori methods do not require information from the assimilation. In this study, we develop a conceptual framework that relates these methods when applied to error variance determination, where each method is associated with the minimization of a particular cost function. The minimization of these cost functions describes a fitting procedure that fits parts of the prescribed modelled innovation covariance to its observed values. Each method must in some way separate the innovation covariance into its contributions from the background and the observations, which are then used in the fitting procedure. It is shown that the examined a posteriori methods use the analysis filter to make this separation and that the minimization of their associated cost functions is done implicitly within the tuning procedure. Analytical expressions for the expectation value and variance of estimates for error variance scaling parameters are determined for each method. The expressions for the expectation values of these estimates show that the accuracy of each method is dependent on its ability to separate the background from the observation contributions to the innovation covariance. This separability is quantified by use of the Frobenius inner product between the background‐ and observation‐error covariances, which additionally allows for geometric interpretations of the covariances to be made. Comparisons between variance parameter estimates from different methods are made for the case of a 1D periodic domain.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,008 | 0,014 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,002 | 0,001 |
| Études des sciences et des technologies | 0,001 | 0,003 |
| Communication savante | 0,003 | 0,002 |
| Science ouverte | 0,003 | 0,003 |
| Intégrité de la recherche | 0,002 | 0,002 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,003 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».