{"id":"W4399114217","doi":"10.1109/access.2024.3406469","title":"Detection and Prediction of Future Mental Disorder From Social Media Data Using Machine Learning, Ensemble Learning, and Large Language Models","year":2024,"lang":"en","type":"article","venue":"IEEE Access","topic":"Mental Health via Writing","field":"Psychology","cited_by":30,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Machine learning; Artificial intelligence; Ensemble learning; Computer science; Task (project management); Ensemble forecasting; Feeling; Social media; Mental illness; Support vector machine; Logistic regression; Mental health; Psychology; Natural language processing; Social psychology; World Wide Web; Psychiatry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001903367,0.001098738,0.0008596641,0.002272671,0.0004350884,0.0009748111,0.0008055281,0.0008130237,0.0005798393],"category_scores_gemma":[0.003931469,0.0002606987,0.001415278,0.001060935,0.0001720319,0.0011711,0.0006415833,0.001728867,0.0006200073],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006187803,"about_ca_system_score_gemma":0.0006634096,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01195206,"about_ca_topic_score_gemma":0.01583244,"domain_scores_codex":[0.9993186,0.0002183401,0.00006611065,0.0001669055,0.0001336264,0.00009634891],"domain_scores_gemma":[0.9978397,0.001287832,0.0001865567,0.0001847784,0.0004066573,0.00009441923],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005847545,0.001669553,0.2064523,0.0002445648,0.0008758156,0.0005976273,0.0003672081,0.2515843,0.0042885,0.001220617,0.01342987,0.518685],"study_design_scores_gemma":[0.000006441879,0.0001253906,0.01088291,0.00002794382,0.00007529614,0.0000804111,0.0001085561,0.9855137,0.001255177,0.001129489,0.0007741524,0.00002040623],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7977961,0.003898298,0.1829676,0.002827483,0.0006567865,0.0002042176,0.005185583,0.002757388,0.003706563],"genre_scores_gemma":[0.9505345,0.000707907,0.04253246,0.0002229077,0.0001607682,0.00008585118,0.004137802,0.00003562111,0.001582077],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01195206,"threshold_uncertainty_score":0.02376503,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06053425226155375,"score_gpt":0.394200777211908,"score_spread":0.3336665249503543,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}