{"id":"W4403596536","doi":"10.36227/techrxiv.172954131.15464807/v1","title":"Classification and Prediction in Data-Driven Analysis for Diverse Applications","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Data mining; Data science; Artificial intelligence; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007290907,0.001019313,0.001307559,0.001719611,0.0007045919,0.003042375,0.001794093,0.001677326,0.001203937],"category_scores_gemma":[0.0176547,0.0007236852,0.001143984,0.002203171,0.001362078,0.00283233,0.002207512,0.002585551,0.0004933329],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001610352,"about_ca_system_score_gemma":0.002196291,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005097148,"about_ca_topic_score_gemma":0.005881713,"domain_scores_codex":[0.996123,0.001845557,0.0002468283,0.0006748688,0.0009420607,0.000167622],"domain_scores_gemma":[0.9877647,0.008874053,0.0007481391,0.001046252,0.001236079,0.0003308851],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001715753,0.0002646827,0.006982536,0.0002220627,0.0001735284,0.0002412708,0.0002022563,0.802133,0.001744913,0.05647463,0.004881046,0.1265084],"study_design_scores_gemma":[0.000004093909,0.00001194607,0.0001865718,0.000008309293,0.000006176285,0.00001404499,0.0000134939,0.9735738,0.000287727,0.02516617,0.000722187,0.000005454162],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01320089,0.0006367788,0.9830561,0.001305727,0.00006537625,0.00009727006,0.0001793153,0.0007402436,0.0007183673],"genre_scores_gemma":[0.5030341,0.0009150007,0.4922788,0.0005418201,0.0002372524,0.0004676422,0.0007878649,0.0001760624,0.001561637],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.007290907,"threshold_uncertainty_score":0.03855842,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07532284866128668,"score_gpt":0.3288045886882752,"score_spread":0.2534817400269885,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}