{"id":"W4400361588","doi":"10.69907/tbj.v1i1.68","title":"Bangla-Align: A forced-aligning toolkit for annotating Bangla speech","year":2024,"lang":"en","type":"article","venue":"TESOL Bangladesh journal","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Bengali; Computer science; Natural language processing; Artificial intelligence; Speech recognition; Programming language","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002489716,0.001783942,0.000972315,0.001961382,0.001841794,0.002777356,0.001673397,0.001136895,0.06759978],"category_scores_gemma":[0.008181639,0.00126868,0.001194086,0.001492781,0.0007202001,0.002942384,0.004057967,0.002028158,0.06423151],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006046794,"about_ca_system_score_gemma":0.001542253,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003284337,"about_ca_topic_score_gemma":0.007384358,"domain_scores_codex":[0.9975594,0.0005622421,0.0003969661,0.0008303458,0.0005063816,0.0001446694],"domain_scores_gemma":[0.9962673,0.00128792,0.0002555228,0.0008692667,0.001119132,0.0002008588],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0007929206,0.0001255471,0.004300756,0.003207885,0.000223414,0.001127396,0.00442757,0.001997104,0.1078973,0.007915467,0.2924825,0.5755022],"study_design_scores_gemma":[0.0001092971,0.0001860411,0.01226881,0.0004865765,0.0001416055,0.003317967,0.002121691,0.02871087,0.06356859,0.01403858,0.8745958,0.0004542154],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"software","genre_scores_codex":[0.01207422,0.001276945,0.7170287,0.0004412098,0.001047368,0.0008525134,0.05747045,0.1774037,0.03240492],"genre_scores_gemma":[0.04086343,0.0004664385,0.827618,0.000434967,0.0001184632,0.001280085,0.07418671,0.03231999,0.02271184],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.06759978,"threshold_uncertainty_score":0.2261438,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0181275496482624,"score_gpt":0.2985027038755927,"score_spread":0.2803751542273303,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}