{"id":"W7082265162","doi":"10.48448/pvr7-v709","title":"INJONGO: A Multicultural Intent Detection and Slot-filling Dataset for 16 African Languages","year":2025,"lang":"en","type":"other","venue":"Underline Science Inc.","topic":"Geochemistry and Geologic Mapping","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; McGill University","funders":"","keywords":"Benchmark (surveying); Transformer; Multiculturalism; First language; Work (physics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008947976,0.001885312,0.0004990601,0.001622026,0.001229293,0.0009506254,0.001348344,0.00138513,0.005670556],"category_scores_gemma":[0.003362409,0.0002918719,0.0008834191,0.001387708,0.0005661721,0.001499893,0.002095002,0.001202847,0.005510499],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007994735,"about_ca_system_score_gemma":0.001398713,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02474452,"about_ca_topic_score_gemma":0.05973661,"domain_scores_codex":[0.9990761,0.0002715135,0.00009440892,0.0002590348,0.0001803443,0.0001185201],"domain_scores_gemma":[0.9989641,0.0003430124,0.0000702292,0.0002074049,0.0002854067,0.0001297511],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001477994,0.0009417569,0.03193901,0.003211728,0.0002494204,0.001921181,0.004155232,0.005409355,0.02736869,0.003628034,0.687387,0.2323106],"study_design_scores_gemma":[0.0004447484,0.0005409159,0.08768648,0.0006226663,0.0001876801,0.002602028,0.01110625,0.05212942,0.02679196,0.005671927,0.811862,0.0003539541],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"dataset","genre_gemma":"empirical","genre_scores_codex":[0.3176695,0.003765652,0.02339932,0.002064459,0.001285944,0.001111034,0.5955086,0.01990635,0.03528915],"genre_scores_gemma":[0.1383521,0.0004573302,0.03317383,0.0005315794,0.0001002858,0.0008420346,0.8167529,0.0006834346,0.009106545],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02474452,"threshold_uncertainty_score":0.04920095,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01706537000273699,"score_gpt":0.275483510077152,"score_spread":0.258418140074415,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}