{"id":"W2898859254","doi":"10.48550/arxiv.1810.12805","title":"Piecewise Strong Convexity of Neural Networks","year":2018,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Stochastic Gradient Optimization Techniques","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Maxima and minima; Piecewise; Mathematics; Convexity; Artificial neural network; Differentiable function; Stochastic gradient descent; Norm (philosophy); Applied mathematics; Regularization (linguistics); Open set; Convex function; Regular polygon; Gradient descent; Mathematical optimization; Mathematical analysis; Computer science; Pure mathematics; Artificial intelligence; Geometry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001404533,0.001149004,0.0008802221,0.001007653,0.0005470993,0.001445691,0.001097055,0.00113836,0.001937747],"category_scores_gemma":[0.008271109,0.0006330651,0.0008016442,0.0005787125,0.001813706,0.002145841,0.001774749,0.002219149,0.0003650076],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001443411,"about_ca_system_score_gemma":0.0005948747,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002621296,"about_ca_topic_score_gemma":0.001065431,"domain_scores_codex":[0.9993927,0.0002205761,0.00002868763,0.0001058567,0.0001687679,0.00008331584],"domain_scores_gemma":[0.997458,0.00149958,0.0002960357,0.0001933897,0.0003784058,0.0001745422],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001187975,0.00003165486,0.001356286,0.0001546337,0.00005428779,0.0003024043,0.0001521984,0.8041465,0.007761147,0.1704637,0.001710106,0.01374842],"study_design_scores_gemma":[0.000003961006,0.00003257516,0.0003745497,0.00001131083,0.000004756345,0.0000440014,0.00002034551,0.9553085,0.001017256,0.04267114,0.0005045519,0.000006974054],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1682678,0.0008984332,0.8186104,0.001717007,0.00004467397,0.00004350401,0.0003345848,0.0004145025,0.009669122],"genre_scores_gemma":[0.9417704,0.0007982405,0.0493428,0.0001939114,0.00007088694,0.0001090482,0.0003997399,0.0002722959,0.007042789],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002621296,"threshold_uncertainty_score":0.01047277,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07283423281946094,"score_gpt":0.1943522013176432,"score_spread":0.1215179684981822,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}