{"id":"W4405693431","doi":"10.1101/2024.12.17.24319113","title":"Why did you use that test? Exploring speech-language pathologists clinical decision-making in bilingual language and literacy assessment","year":2024,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Interpreting and Communication in Healthcare","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University; University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; Ministry of Colleges and Universities","keywords":"Test (biology); Language assessment; Literacy; Linguistics; Computer science; Psychology; Natural language processing; Pedagogy","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04096317,0.0002828648,0.0004173538,0.001852789,0.004652152,0.005172236,0.001468676,0.00171796,0.001806883],"category_scores_gemma":[0.1012886,0.0004397215,0.0004544329,0.001051461,0.007453426,0.003324734,0.004568319,0.003050245,0.000521193],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01083012,"about_ca_system_score_gemma":0.03156669,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.06485106,"about_ca_topic_score_gemma":0.1216915,"domain_scores_codex":[0.9579214,0.03033685,0.002431944,0.001579555,0.004976455,0.002753753],"domain_scores_gemma":[0.9341828,0.03788577,0.008957528,0.001080299,0.01091931,0.00697441],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.0002850601,0.0003066216,0.2593993,0.0009073039,0.00005551182,0.007094592,0.5569287,0.0004090116,0.00296367,0.00670567,0.01058355,0.154361],"study_design_scores_gemma":[0.00006431065,0.0004071968,0.08939181,0.00420104,0.00008739019,0.008168848,0.8172009,0.002487212,0.003929492,0.01290435,0.06088587,0.0002716026],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9278546,0.00339219,0.01044118,0.0405635,0.0002987682,0.0003461425,0.0001382322,0.00006276213,0.01690272],"genre_scores_gemma":[0.9842312,0.001457699,0.009869822,0.003218971,0.00004482581,0.0001342849,0.00004580396,0.00002873216,0.0009686938],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.06485106,"threshold_uncertainty_score":0.2166365,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1920369956570926,"score_gpt":0.5393583305161669,"score_spread":0.3473213348590742,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}