{"id":"W4286769904","doi":"10.2196/33460","title":"Evaluating Web-Based Automatic Transcription for Alzheimer Speech Data: Transcript Comparison and Machine Learning Analysis","year":2022,"lang":"en","type":"article","venue":"JMIR Aging","topic":"Mental Health via Writing","field":"Psychology","cited_by":23,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of the Fraser Valley; University of British Columbia","funders":"Vancouver Coastal Health Research Institute; Alzheimer's Society; Consortium canadien en neurodégénérescence associée au vieillissement","keywords":"Transcription (linguistics); Naive Bayes classifier; Computer science; Confidence interval; Random forest; Logistic regression; Speech recognition; Natural language processing; Artificial intelligence; Machine learning; Medicine; Support vector machine; Internal medicine","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01632138,0.0007609215,0.0006077462,0.00317823,0.0005842597,0.001385467,0.0008407552,0.0008644925,0.002674211],"category_scores_gemma":[0.05777588,0.0001847985,0.0007786954,0.001352149,0.0007676203,0.0009189209,0.001237894,0.0005796658,0.002099636],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008031616,"about_ca_system_score_gemma":0.000896287,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001963297,"about_ca_topic_score_gemma":0.002808055,"domain_scores_codex":[0.9849207,0.009407504,0.001649739,0.001657397,0.002074929,0.0002897145],"domain_scores_gemma":[0.9265824,0.04676512,0.00544072,0.003821935,0.01642914,0.0009606722],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.008987692,0.001890851,0.2599526,0.002914467,0.0008749689,0.001510898,0.01097036,0.01420679,0.09833742,0.001215759,0.00889972,0.5902385],"study_design_scores_gemma":[0.001091233,0.007275265,0.5932049,0.0006488343,0.00100789,0.003872561,0.01093194,0.2465111,0.1184098,0.003725509,0.01283651,0.0004844592],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8944545,0.0005959774,0.09411144,0.0002536268,0.0001911413,0.001846447,0.004257258,0.001768305,0.002521352],"genre_scores_gemma":[0.8765846,0.0003994203,0.1098666,0.0001557239,0.0001854424,0.002223164,0.008967248,0.000287228,0.001330535],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01632138,"threshold_uncertainty_score":0.0863167,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2244253383099157,"score_gpt":0.4714849167556804,"score_spread":0.2470595784457648,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}