{"id":"W3204466917","doi":"10.31224/osf.io/d4e6a","title":"Log Message Anomaly Detection with Oversampling","year":2020,"lang":"en","type":"article","venue":"","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Victoria","funders":"","keywords":"Oversampling; Autoencoder; Anomaly detection; Computer science; Data mining; Anomaly (physics); Feature (linguistics); Artificial intelligence; Feature extraction; Pattern recognition (psychology); Deep learning; Computer network","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001164327,0.0007240602,0.0008405729,0.00106757,0.0003425856,0.0007299981,0.0008542264,0.0006092756,0.0004184084],"category_scores_gemma":[0.004608433,0.000220984,0.0003836065,0.0007496065,0.0005261771,0.001420463,0.0007919559,0.001114428,0.0003484291],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000596671,"about_ca_system_score_gemma":0.0005439552,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003795368,"about_ca_topic_score_gemma":0.003895335,"domain_scores_codex":[0.9992974,0.0001366348,0.00003337874,0.0001998197,0.0002517408,0.00008110634],"domain_scores_gemma":[0.9978995,0.0008435118,0.0003122859,0.0004458428,0.0004225442,0.00007634715],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007858203,0.0004383484,0.04600796,0.00007762406,0.000120567,0.0003968785,0.0002350637,0.4120481,0.02791012,0.003801633,0.005050136,0.5031278],"study_design_scores_gemma":[0.000004309519,0.00004169457,0.002056433,0.000001975957,0.000005052846,0.00006342783,0.00001973873,0.9927799,0.002901455,0.001739195,0.000381782,0.000005039943],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3401213,0.0003489842,0.6529172,0.0005726352,0.0001742812,0.00009778656,0.0003640557,0.004227281,0.001176528],"genre_scores_gemma":[0.9448333,0.0000919646,0.05308836,0.00008373855,0.0000832849,0.00003835615,0.000627136,0.00006725464,0.001086541],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003795368,"threshold_uncertainty_score":0.007546544,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0176578058795135,"score_gpt":0.2231296155373557,"score_spread":0.2054718096578422,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}