{"id":"W4388821020","doi":"10.1109/idsta58916.2023.10317844","title":"Incorporating Data Preparation and Clustering Techniques for Workload Segmentation in Large-Scale Cloud Data Centers","year":2023,"lang":"en","type":"article","venue":"","topic":"Cloud Computing and Resource Management","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"","keywords":"Cloud computing; Computer science; Workload; Cluster analysis; Data mining; Scheduling (production processes); Data center; Virtual machine; Distributed computing; Big data; Artificial intelligence; Computer network; Operating system; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002332,0.0009323437,0.0007799211,0.001727209,0.001428624,0.001380252,0.001515818,0.0008465601,0.0005151716],"category_scores_gemma":[0.006296334,0.000632857,0.000991725,0.00222259,0.0007290766,0.001876711,0.001111362,0.001151855,0.0004231684],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001521106,"about_ca_system_score_gemma":0.002354779,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009923311,"about_ca_topic_score_gemma":0.01277341,"domain_scores_codex":[0.9986668,0.0003694409,0.0001230191,0.0003455371,0.0003607015,0.0001346074],"domain_scores_gemma":[0.9965799,0.001315062,0.0003643631,0.000692981,0.0008661321,0.000181511],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005992823,0.0007302922,0.02575188,0.0003340747,0.0001597023,0.0002744471,0.001167843,0.6118513,0.03816581,0.008025547,0.005070806,0.307869],"study_design_scores_gemma":[0.00001680833,0.00009150012,0.004773833,0.00001376045,0.00001712971,0.00006840564,0.0002342481,0.9778168,0.0101804,0.005280855,0.001474393,0.00003178231],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07650103,0.0001614901,0.9193398,0.0003732342,0.00004806883,0.0005069443,0.0003590196,0.001984979,0.0007253807],"genre_scores_gemma":[0.5095463,0.0001609467,0.4879389,0.0001027346,0.00003785662,0.0003685381,0.001015416,0.0001826794,0.0006467487],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009923311,"threshold_uncertainty_score":0.0197311,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04942068923362901,"score_gpt":0.3205207961967169,"score_spread":0.2711001069630879,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}