{"id":"W3208592040","doi":"","title":"Towards Noise-adaptive, Problem-adaptive Stochastic Gradient Descent","year":2021,"lang":"fr","type":"preprint","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","topic":"Stochastic Gradient Optimization Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Noise (video); Stochastic gradient descent; Gradient descent; Computer science; Mathematical optimization; Control theory (sociology); Mathematics; Artificial intelligence; Artificial neural network","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003231161,0.00181136,0.001141149,0.0008396507,0.0004164028,0.001162968,0.00216132,0.002187314,0.001403264],"category_scores_gemma":[0.01427126,0.0007693131,0.0009776331,0.0007017198,0.00181777,0.001419425,0.002725685,0.002694037,0.0008524379],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001270491,"about_ca_system_score_gemma":0.002273399,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003678366,"about_ca_topic_score_gemma":0.003271715,"domain_scores_codex":[0.9985068,0.0005831009,0.00007639478,0.0002961032,0.0004329327,0.0001045479],"domain_scores_gemma":[0.995609,0.002732792,0.0003963612,0.0004245454,0.0006287079,0.0002085844],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001467451,0.0001118766,0.000851272,0.0002213626,0.00007881223,0.00008382833,0.0001042802,0.9059244,0.006672885,0.04307381,0.002468962,0.0402617],"study_design_scores_gemma":[0.00001075193,0.00002468248,0.00004305038,0.000007452877,0.000002943873,0.000009991577,0.000002768634,0.993718,0.0005575751,0.005164887,0.0004541013,0.000003662263],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.003479856,0.0001316072,0.9952743,0.000131138,0.00003027037,0.00002764728,0.00001671848,0.0002169146,0.0006914332],"genre_scores_gemma":[0.188713,0.0003376778,0.8064581,0.0005158701,0.0001327595,0.0003243681,0.0002117924,0.0003268828,0.002979442],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003678366,"threshold_uncertainty_score":0.01708823,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02751191910310913,"score_gpt":0.2317008800844014,"score_spread":0.2041889609812923,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}