{"id":"W3196823214","doi":"10.48550/arxiv.2108.13587","title":"T3-Vis: a visual analytic framework for Training and fine-Tuning Transformers in NLP","year":2021,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Software Engineering Research","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Suite; Transformer; Computer science; Visualization; Artificial intelligence; Architecture; Focus (optics); Process (computing); Machine learning; Natural language processing; Programming language; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004765207,0.002358303,0.0009205925,0.003082694,0.001018357,0.004685413,0.003178502,0.002075202,0.01798149],"category_scores_gemma":[0.02464682,0.0009778421,0.002297289,0.001363472,0.002387651,0.006133902,0.004491554,0.003646843,0.003728343],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001662676,"about_ca_system_score_gemma":0.002266192,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006361731,"about_ca_topic_score_gemma":0.009461291,"domain_scores_codex":[0.9981425,0.0009247913,0.0001266279,0.0003484507,0.0003699848,0.00008771908],"domain_scores_gemma":[0.9923381,0.00583072,0.0003144202,0.0007258712,0.0005249157,0.0002660374],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008228464,0.0002053497,0.002200594,0.001657559,0.0002009112,0.0005730205,0.003021108,0.2221968,0.01627622,0.2490108,0.04491059,0.4589242],"study_design_scores_gemma":[0.00007798691,0.00007224162,0.0001914613,0.0002086779,0.00003368935,0.0001447485,0.0002545563,0.7228202,0.006018367,0.2392486,0.0308787,0.00005079537],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0009663558,0.00008226375,0.989599,0.0002629143,0.00002514508,0.00006297079,0.0003199446,0.007713433,0.0009679898],"genre_scores_gemma":[0.05604566,0.0002924556,0.9392195,0.0002299141,0.00004508203,0.0003516407,0.0007877881,0.001937276,0.001090682],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01798149,"threshold_uncertainty_score":0.06015408,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09381849016606994,"score_gpt":0.24494936643289,"score_spread":0.15113087626682,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}