{"id":"W4389575940","doi":"10.1109/csnet59123.2023.10339765","title":"Exploring Semantic vs. Syntactic Features for Unsupervised Learning on Application Log Files","year":2023,"lang":"en","type":"article","venue":"","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Unsupervised learning; Anomaly detection; Artificial intelligence; Natural language processing","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001586747,0.00009633195,0.00009475066,0.0001572689,0.0003100277,0.00009953132,0.0003429735,0.00003901678,0.000007557427],"category_scores_gemma":[0.00003620338,0.00008795688,0.00006518281,0.0005228161,0.00001185422,0.0002695647,0.00007889832,0.0001094464,0.0001835693],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002681594,"about_ca_system_score_gemma":0.00001211097,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003138821,"about_ca_topic_score_gemma":0.000003888352,"domain_scores_codex":[0.999199,0.00001706502,0.0001317084,0.0003406901,0.0001196212,0.000191944],"domain_scores_gemma":[0.9993113,0.0001965239,0.00004971273,0.0003508565,0.0000459105,0.00004572958],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001965405,0.00008181759,0.0002720227,0.0000844427,0.00002476911,0.000001694808,0.0004751181,0.002601787,0.01609093,0.6186524,0.006801439,0.3548939],"study_design_scores_gemma":[0.0005367106,0.0006642443,0.0278314,0.00007484356,0.00002391185,0.00001649423,0.0004109699,0.6532641,0.1871004,0.02473195,0.1045639,0.0007811935],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02344862,0.000005800459,0.9704634,0.002058662,0.0000604432,0.0004565361,0.00000123239,0.002160328,0.001344995],"genre_scores_gemma":[0.9805369,0.00005637152,0.0158706,0.0001967377,0.00006582641,0.001638602,0.00001232615,0.00001428042,0.001608391],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9570882,"threshold_uncertainty_score":0.3586777,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0673249099224138,"score_gpt":0.2822303584163148,"score_spread":0.214905448493901,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}