{"id":"W4387250519","doi":"10.1109/asap57973.2023.00024","title":"Efficient 1D Grouped Convolution for PyTorch a Case Study: Fast On-Device Fine-Tuning for SqueezeBERT","year":2023,"lang":"en","type":"article","venue":"","topic":"Advanced Neural Network Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Convolution (computer science); Locality; Edge device; Enhanced Data Rates for GSM Evolution; Inference; Memory management; Parallel computing; Reduction (mathematics); Algorithm; Edge computing; Base (topology); Computational science; Computer engineering; Theoretical computer science; Artificial intelligence; Computer hardware; Mathematics; Semiconductor memory; Operating system","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003340635,0.0001673191,0.0001722089,0.0001377916,0.0004934122,0.00007434203,0.0004558005,0.00004288271,0.000002535456],"category_scores_gemma":[0.00007848859,0.0001525554,0.00008343573,0.0009688796,0.00002500196,0.0001007019,0.0001933041,0.00008965256,0.00005799929],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007858611,"about_ca_system_score_gemma":0.0000363887,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00005277871,"about_ca_topic_score_gemma":0.0001931676,"domain_scores_codex":[0.998444,0.0000347876,0.0002726059,0.00062597,0.0001942109,0.0004284365],"domain_scores_gemma":[0.9980162,0.001033427,0.0000872563,0.0006000535,0.0001626228,0.0001004002],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001998109,0.001590061,0.0003289489,0.0001209143,0.0001203093,0.0003418943,0.005611611,0.4984424,0.007015811,0.3017555,0.02873044,0.1557423],"study_design_scores_gemma":[0.001026236,0.0003885584,0.0001429618,0.000009182933,0.0000108993,0.00005112946,0.0003913648,0.9936184,0.0002403186,0.0009127299,0.003009009,0.0001991615],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1806393,0.000006346156,0.8149372,0.001032609,0.0002402398,0.002396519,0.00001190975,0.000609545,0.0001262793],"genre_scores_gemma":[0.9566364,7.136296e-7,0.04000634,0.0003030553,0.0001614011,0.001813573,0.00001678429,0.00002431228,0.001037463],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.775997,"threshold_uncertainty_score":0.6221028,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06023549413193496,"score_gpt":0.3403309898159317,"score_spread":0.2800954956839968,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}