{"id":"W2031513172","doi":"10.1109/issre.2014.34","title":"Failure Analysis of Jobs in Compute Clouds: A Google Cluster Case Study","year":2014,"lang":"en","type":"article","venue":"","topic":"Cloud Computing and Resource Management","field":"Computer Science","cited_by":92,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Cloud computing; Computer science; Workload; Reliability (semiconductor); Cluster (spacecraft); Scheduling (production processes); Limiting; TRACE (psycholinguistics); Task (project management); Node (physics); Distributed computing; Data mining; Computer network; Operating system; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001572986,0.000988782,0.0005902176,0.002496113,0.001450279,0.0007404297,0.001542231,0.0008573275,0.0004116842],"category_scores_gemma":[0.004716025,0.0003164414,0.0005207339,0.00281724,0.001320574,0.0007921295,0.0006878141,0.0006754916,0.0001333752],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001552766,"about_ca_system_score_gemma":0.001314243,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.06569535,"about_ca_topic_score_gemma":0.04741676,"domain_scores_codex":[0.9986028,0.0002205353,0.0000759242,0.0001700995,0.0006240029,0.0003066446],"domain_scores_gemma":[0.9957222,0.001880125,0.0005275538,0.0005323833,0.0009185745,0.0004191279],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001714107,0.0006883738,0.4547084,0.0005361494,0.00032119,0.008031535,0.00322172,0.4419099,0.02061868,0.004655878,0.008573698,0.0550203],"study_design_scores_gemma":[0.00005059438,0.0004273294,0.2223891,0.00004024414,0.00008120962,0.001732393,0.003088912,0.7561252,0.01023493,0.002766789,0.002960014,0.0001032241],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9956321,0.0001331416,0.002934832,0.0001434724,0.00001293421,0.00005887122,0.0003279498,0.0001945503,0.0005620829],"genre_scores_gemma":[0.9975783,0.00005567109,0.001792397,0.00001423579,0.000008579563,0.00001608607,0.0003204976,0.00002470418,0.0001895323],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.06569535,"threshold_uncertainty_score":0.1306259,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0113984765444589,"score_gpt":0.2455496560672263,"score_spread":0.2341511795227673,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}