{"id":"W4410426493","doi":"10.2139/ssrn.5257431","title":"Improving Vision Transformers by Overlapping Heads in Multi-Head Self-Attention","year":2025,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Brain Tumor Detection and Classification","field":"Neuroscience","cited_by":1,"is_retracted":false,"has_abstract":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Transformer; Head (geology); Computer vision; Computer science; Artificial intelligence; Optometry; Engineering; Electrical engineering; Medicine; Geology; Voltage","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000753145,0.001085656,0.001262111,0.0009048156,0.0005085531,0.0009545907,0.001210298,0.001224222,0.006179915],"category_scores_gemma":[0.002346537,0.0005451758,0.0008337299,0.0009820425,0.0004231361,0.001437416,0.002094589,0.0007748695,0.001749372],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003688299,"about_ca_system_score_gemma":0.0009601383,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004008568,"about_ca_topic_score_gemma":0.005986255,"domain_scores_codex":[0.9994799,0.00009788702,0.00002433972,0.0001482606,0.0001210919,0.0001285521],"domain_scores_gemma":[0.9991083,0.0003868871,0.00004380142,0.0001725206,0.0002087517,0.00007973929],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009397082,0.0002796207,0.001518228,0.0001725931,0.0002050914,0.0001666529,0.0001614659,0.02314124,0.1052939,0.002322573,0.004817139,0.8609818],"study_design_scores_gemma":[0.00007122054,0.0004785967,0.008068453,0.00003303489,0.0003897522,0.000851877,0.000146388,0.8208842,0.1516395,0.01191872,0.00545116,0.00006705281],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06421006,0.001020832,0.9279345,0.0001737334,0.0001744584,0.00007803401,0.0002022397,0.00282854,0.003377531],"genre_scores_gemma":[0.753023,0.0008075901,0.2364658,0.000414065,0.0002624929,0.0001067303,0.0006845482,0.0004378849,0.007797939],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006179915,"threshold_uncertainty_score":0.02067393,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01904065188785814,"score_gpt":0.2948945107666868,"score_spread":0.2758538588788287,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}