{"id":"W7008845853","doi":"","title":"Deep networks training and generalization: insights from linearization","year":2023,"lang":"fr","type":"dissertation","venue":"Papyrus : Institutional Repository (Université de Montréal)","topic":"Stochastic Gradient Optimization Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Instituto de Ciencias del Mar y Limnología, Universidad Nacional Autónoma de México; Institute for Catastrophic Loss Reduction","keywords":"Linearization; Reprojection error; Counterweight","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000781362,0.000603397,0.0005132576,0.0005526221,0.0003311545,0.00104727,0.0008734526,0.0006711604,0.005074413],"category_scores_gemma":[0.003873404,0.000476123,0.0006009567,0.0005166316,0.001026614,0.00196967,0.001385966,0.001286754,0.0008388918],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001117288,"about_ca_system_score_gemma":0.0007125136,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004684997,"about_ca_topic_score_gemma":0.004383269,"domain_scores_codex":[0.9996802,0.0001002726,0.00001958009,0.00006457375,0.0001023362,0.00003306557],"domain_scores_gemma":[0.9991642,0.0005056729,0.00007681853,0.0001167178,0.0001088345,0.00002774742],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00006906377,0.00004305532,0.001390105,0.0003560342,0.00005960902,0.0002025832,0.0004553419,0.4809811,0.008964834,0.3444886,0.003493966,0.1594957],"study_design_scores_gemma":[0.00000841252,0.00004718585,0.0005572871,0.00006977182,0.00001588526,0.00009692023,0.00006086019,0.844162,0.003383859,0.145411,0.006166074,0.00002073909],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02049504,0.002385228,0.9497434,0.001328714,0.00008218073,0.00003533491,0.0001395421,0.0006507733,0.02513973],"genre_scores_gemma":[0.7843711,0.007610023,0.1680512,0.0007672338,0.0003837921,0.0002155785,0.0003326131,0.0005216914,0.03774671],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005074413,"threshold_uncertainty_score":0.01697558,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01261321955773689,"score_gpt":0.1853150738569515,"score_spread":0.1727018542992146,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}