MétaCan
Menu
Retour à la cohorte
Enregistrement W4391514381 · doi:10.48550/arxiv.2402.00107

Light curves for variable, point-like microlensing, and extended objects microlensing sources with regular cadence and OGLE-II timestamps cadence.

2024· preprint· en· W4391514381 sur OpenAlexaff
Miguel Crispim Romão, Djuna Croon

Notice bibliographique

RevuearXiv (Cornell University) · 2024
Typepreprint
Langueen
DomaineEngineering
ThématiqueOptical Polarization and Ellipsometry
Établissements canadiensInstitute of Particle Physics
Organismes subventionnairesScience and Technology Facilities CouncilUK Research and Innovation
Mots-clésGravitational microlensingComputer scienceArtificial intelligenceComputer visionStars

Résumé

récupéré en direct d'OpenAlex

This is the dataset used in the paper Microlensing signatures of extended dark objects using machine learning, which should be read for more details, and the code repository for the simulation code. This dataset comprises 600,000 light curves designed for the detection of microlensing events. These curves are categorised into six classes: Cataclysmic Variables (CV), RR Lyrae and Cepheid Variables (VARIABLE), Mira Long-Period variable (LPV), Point-like Microlensing (ML), Boson Stars (BS), and NFW Subhalos (NFW). The dataset includes simulated light curves for each class, with 100,000 instances per class. ML light curves are simulated using MicroLIA, while BS and NFW light curves were simulated using the respective mass profiles first computed here. Selection criteria, including a minimum magnification of 1.34, were applied to mimic a survey selection. The light curves have magnitudes between 15 and 20, incorporate Gaussian noise, and were generated with two cadence scenarios: OGLE-II timestamps and Regular Daily Cadence. For the extended microlensing sources (BS and NFW), mass profiles depend on a parameter, τₘ, sampled logarithmically from a uniform distribution. The minimal impact parameter, u₀, is sampled differently for each microlensing source class. A total of 148 features are computed for each light curve, encompassing statistics and derivatives of the time series. The dataset has 189 columns (see 'columns.txt' file), grouped by type identified by a prefix: 'lc' columns: light curve. 'gen' columns: generation parameters (metadata). 'sim' columns: simulation parameters (metadata). 'feat' columns: light curve time series features. See MicroLIA (and respective paper) for more details. Features computed on the derivative time series are marked with suffix 'deriv'. The dataset files are stored in 'parquet' format, which can be read in python using 'pandas' by installing the 'parquet' optional depence (i.e. 'pip install pandas[parquet]').

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,000
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMéta-épidémiologie (sens strict)
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Simulation ou modélisation · Signal consensuel: Simulation ou modélisation
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,322
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0000,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,001
Intégrité de la recherche0,0000,001
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,016
Tête enseignante GPT0,158
Écart entre enseignants0,142 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Devis d'étudeSimulation ou modélisation
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations0
Publié2024
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revuearXiv (Cornell University)Même sujetOptical Polarization and EllipsometryTravaux en français237 207