{"id":"W2894591993","doi":"10.1109/allerton.2018.8635903","title":"Anytime Stochastic Gradient Descent: A Time to Hear from all the Workers","year":2018,"lang":"en","type":"article","venue":"","topic":"Stochastic Gradient Optimization Techniques","field":"Computer Science","cited_by":22,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Stochastic gradient descent; Exploit; Computation; Convergence (economics); Node (physics); Distributed computing; Focus (optics); Acceleration; Algorithm; Artificial intelligence; Computer security; Artificial neural network","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001816224,0.001321577,0.001150753,0.0003062793,0.0009356523,0.00119441,0.002540033,0.001403942,0.004492874],"category_scores_gemma":[0.004944245,0.0006554533,0.0006113254,0.0006041888,0.001310198,0.002040142,0.002149488,0.002249399,0.001773329],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007497811,"about_ca_system_score_gemma":0.002960403,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004010564,"about_ca_topic_score_gemma":0.006841982,"domain_scores_codex":[0.9987828,0.0003535681,0.00004206253,0.0002321072,0.0004423851,0.0001469969],"domain_scores_gemma":[0.9984781,0.0005867955,0.0001295218,0.0003830847,0.0002572544,0.0001653323],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009217019,0.0002566745,0.001671626,0.0002765328,0.0001916867,0.000348802,0.0005864569,0.5559015,0.01805611,0.06391136,0.01628314,0.3415945],"study_design_scores_gemma":[0.00007610363,0.00008256025,0.000126752,0.00001265185,0.00002155739,0.00004052409,0.00005233335,0.971939,0.00326054,0.01875929,0.005614943,0.00001380671],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.004599798,0.0001687672,0.9919892,0.0003886161,0.0001012458,0.00003280561,0.00001412249,0.0008941859,0.001811365],"genre_scores_gemma":[0.2366932,0.0003488484,0.7516721,0.0005665037,0.0002355127,0.0002346795,0.0001475601,0.0005719744,0.009529571],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004492874,"threshold_uncertainty_score":0.01503021,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01617655381045896,"score_gpt":0.2389224668351279,"score_spread":0.2227459130246689,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}