The ATLAS Virtual Research Assistant
Notice bibliographique
Résumé
Abstract We present the Virtual Research Assistant (VRA) of the ATLAS sky survey, which performs preliminary eyeballing on our clean transient data stream. The VRA uses histogram-based gradient-boosted decision tree classifiers trained on real data to score incoming alerts on two axes: “Real” and “Galactic.” The alerts are then ranked using a geometric distance such that the most “real” and “extragalactic” receive high scores; the scores are updated when new lightcurve data is obtained on subsequent visits. To assess the quality of the training we use the recall at rank K, which is more informative to our science goal than general metrics (e.g., accuracy, F1-scores). We also establish benchmarks for our metric based on the pre-VRA eyeballing strategy, to ensure our models provide notable improvements before being added to the ATLAS pipeline. Then, policies are defined on the ranked list to select the most promising alerts for humans to eyeball and to automatically remove bogus alerts. In production the VRA method has resulted in a reduction in eyeballing workload by 85% with a loss of follow-up opportunity <0.08%. It also allows us to automatically trigger follow-up observations with the Lesedi telescope, paving the way toward automated methods that will be required in the era of LSST. Finally, this is a demonstration that feature-based methods remain extremely relevant in our field, being trainable on only a few thousand samples and highly interpretable; they also offer a direct way to inject expertise into models through feature engineering.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,004 | 0,010 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,002 | 0,001 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,004 | 0,003 |
| Science ouverte | 0,004 | 0,006 |
| Intégrité de la recherche | 0,001 | 0,002 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,101 | 0,069 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».