{"id":"W2900457592","doi":"","title":"Deep Nets Don't Learn via Memorization","year":2017,"lang":"en","type":"article","venue":"PolyPublie (École Polytechnique de Montréal)","topic":"Stochastic Gradient Optimization Techniques","field":"Computer Science","cited_by":60,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University; Polytechnique Montréal; Université de Montréal","funders":"","keywords":"Memorization; Computer science; Artificial intelligence; Mathematics education; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007328267,0.001070558,0.0009186123,0.0003367524,0.0003643545,0.001429858,0.002057171,0.001808806,0.01443703],"category_scores_gemma":[0.005447048,0.0008534127,0.0006062932,0.0004043082,0.001072358,0.004821208,0.002063323,0.003222055,0.004697471],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007121141,"about_ca_system_score_gemma":0.001066595,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001959404,"about_ca_topic_score_gemma":0.004396847,"domain_scores_codex":[0.9994954,0.00007353233,0.00002792021,0.0001554316,0.0001705882,0.00007716888],"domain_scores_gemma":[0.9981663,0.0007718101,0.000154825,0.0005870465,0.00022523,0.00009490782],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003556748,0.000206854,0.00126249,0.0003594315,0.0001510102,0.0001973432,0.00009012846,0.1699848,0.01361882,0.1117037,0.03157024,0.6704995],"study_design_scores_gemma":[0.00004015636,0.0001139722,0.0003783054,0.00003757931,0.00004631495,0.0001458104,0.00001853742,0.8768574,0.01072646,0.102333,0.009278419,0.00002398562],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02114241,0.0006389839,0.956246,0.001449304,0.0005018499,0.00007174303,0.000379466,0.004338693,0.01523144],"genre_scores_gemma":[0.6452709,0.001089375,0.2433648,0.001537991,0.0005262354,0.0003056941,0.001539021,0.001676055,0.1046898],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01443703,"threshold_uncertainty_score":0.04829663,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01166250967440062,"score_gpt":0.2350985713370607,"score_spread":0.2234360616626601,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}