{"id":"W4403094786","doi":"10.22541/au.172797494.46569043/v1","title":"Evaluation of Local Explainability Methods in Turkish Text Classification Tasks","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Turkish; Computer science; Artificial intelligence; Natural language processing; Linguistics; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006080743,0.00171051,0.0008505077,0.00266035,0.0005899221,0.001136918,0.001316195,0.001637887,0.002101815],"category_scores_gemma":[0.01724323,0.0002314104,0.001098239,0.001597977,0.0006609065,0.002591879,0.001504994,0.001689235,0.0005659784],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001085593,"about_ca_system_score_gemma":0.000770306,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004277017,"about_ca_topic_score_gemma":0.006070731,"domain_scores_codex":[0.9973654,0.001209715,0.0001969977,0.0006940493,0.0003738488,0.0001600421],"domain_scores_gemma":[0.9844818,0.01226239,0.0007787074,0.001126862,0.0009828489,0.0003674372],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003651351,0.001080614,0.04653588,0.001220754,0.0009683382,0.0004392852,0.0008753031,0.2601381,0.01258444,0.00449491,0.007832164,0.6601788],"study_design_scores_gemma":[0.0001412869,0.0007637143,0.01371509,0.0000572184,0.0002122832,0.0001562385,0.0002905156,0.9712068,0.008270248,0.003973035,0.001172296,0.00004125892],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7698892,0.00464988,0.2138058,0.0006507981,0.0001754258,0.0003267262,0.001391709,0.005227704,0.003882781],"genre_scores_gemma":[0.9374149,0.0003953323,0.0564345,0.00007586661,0.00009432311,0.0001435994,0.004045476,0.0002251661,0.001170753],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006080743,"threshold_uncertainty_score":0.03215843,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1800156534794118,"score_gpt":0.443886896661136,"score_spread":0.2638712431817242,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}