{"id":"W4385566910","doi":"10.18653/v1/2023.semeval-1.281","title":"UAlberta at SemEval-2023 Task 1: Context Augmentation and Translation for Multilingual Visual Word Sense Disambiguation","year":2023,"lang":"en","type":"article","venue":"","topic":"Multimodal Machine Learning Applications","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; Alberta Machine Intelligence Institute","keywords":"SemEval; Computer science; Natural language processing; Task (project management); Encoder; Artificial intelligence; Context (archaeology); Word (group theory); Machine translation; Code (set theory); Word-sense disambiguation; Set (abstract data type); Text segmentation; Test set; Segmentation; Linguistics; Programming language; WordNet","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004472996,0.004955817,0.002932136,0.004445743,0.003265898,0.004817784,0.004670256,0.003177034,0.06625327],"category_scores_gemma":[0.009551177,0.001671358,0.0025346,0.003058861,0.001509661,0.005031053,0.00742639,0.00349765,0.07936787],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00311386,"about_ca_system_score_gemma":0.004675064,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.06894369,"about_ca_topic_score_gemma":0.08856311,"domain_scores_codex":[0.9953948,0.001095929,0.0002560021,0.001835595,0.0009412009,0.0004765003],"domain_scores_gemma":[0.9949432,0.001010984,0.0001613059,0.001932772,0.00141652,0.0005351657],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009710314,0.000374854,0.00124545,0.001471899,0.0001862528,0.0004802344,0.0004290602,0.002512804,0.01285171,0.004708814,0.7422071,0.232561],"study_design_scores_gemma":[0.001111984,0.0004456965,0.007388484,0.0007437372,0.0002050087,0.001563117,0.001447996,0.08015189,0.0641396,0.02369287,0.8187101,0.0003995612],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"software","genre_gemma":"empirical","genre_scores_codex":[0.03917024,0.006832208,0.1537557,0.002485877,0.003976711,0.002065219,0.2110401,0.4965185,0.0841554],"genre_scores_gemma":[0.09984785,0.001062674,0.3122797,0.001569099,0.0003292486,0.001677753,0.5192772,0.02912942,0.0348271],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.06894369,"threshold_uncertainty_score":0.2216393,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03527268440563371,"score_gpt":0.3497033459564788,"score_spread":0.3144306615508451,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}