{"id":"W7117980404","doi":"10.1109/fnwf66845.2025.11317173","title":"Live Testing of Cloud Services: A Framework and Lessons Learned","year":2025,"lang":"","type":"article","venue":"","topic":"Software-Defined Networks and 5G","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University; Université du Québec à Chicoutimi","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Cloud computing; Software deployment; Production (economics); Scalability; Set (abstract data type); Architecture; Development environment; Integration testing","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0005086735,0.0003201323,0.0005246545,0.0001605835,0.0003265498,0.000360633,0.0009743356,0.0003381749,0.00008002511],"category_scores_gemma":[0.0004140948,0.0003008239,0.00009880001,0.002002714,0.0001865049,0.0002679505,0.001402761,0.0005237302,0.00002722482],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002580574,"about_ca_system_score_gemma":0.0002506973,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006561772,"about_ca_topic_score_gemma":0.00006484026,"domain_scores_codex":[0.9975817,0.0001318565,0.0005959897,0.0008566862,0.0002766679,0.0005570797],"domain_scores_gemma":[0.9955952,0.002777545,0.0002646553,0.0008987989,0.0003080291,0.0001557902],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003273815,0.0001830297,0.04727295,0.0005646592,0.0001406384,0.00001431282,0.004522248,0.001349269,0.00003121687,0.3536172,0.0005316767,0.5917401],"study_design_scores_gemma":[0.0009386393,0.0005829362,0.02117068,0.006797044,0.0001633976,0.00001422214,0.001469693,0.7627836,0.0002486143,0.2013536,0.003745193,0.000732342],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07026638,0.007264374,0.9046088,0.006841774,0.00198146,0.0003682229,0.000007840734,0.0002971458,0.008364012],"genre_scores_gemma":[0.8610188,0.0006046917,0.1346619,0.002069592,0.0001914936,0.000008612043,8.161914e-7,0.0000149935,0.001429094],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.7907524,"threshold_uncertainty_score":0.9999444,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0440305741084206,"score_gpt":0.3008645041182288,"score_spread":0.2568339300098082,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}