{"id":"W3021005190","doi":"10.2196/17650","title":"Automatic Construction of a Depression-Domain Lexicon Based on Microblogs: Text Mining Study","year":2020,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Mental Health via Writing","field":"Psychology","cited_by":34,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"National Office for Philosophy and Social Sciences; University of International Business and Economics","keywords":"Lexicon; Word2vec; Microblogging; Social media; Computer science; Artificial intelligence; Depression (economics); Feeling; Natural language processing; Machine learning; Psychology; World Wide Web; Social psychology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0006366729,0.0001755032,0.0003848112,0.0001217484,0.00009214255,0.00001493864,0.0002761226,0.0002038025,0.003018792],"category_scores_gemma":[0.000250275,0.000151504,0.0000609448,0.0002965446,0.0001620604,0.00009452622,0.00008060119,0.0004113199,0.0002466069],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005248216,"about_ca_system_score_gemma":0.0001628946,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001044801,"about_ca_topic_score_gemma":0.000002216105,"domain_scores_codex":[0.9972396,0.0002126751,0.001304455,0.0001480546,0.0007628375,0.0003323895],"domain_scores_gemma":[0.9982764,0.0004814509,0.0004956994,0.0002927989,0.00003888354,0.0004148036],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.0007438984,0.003396993,0.146407,0.004767849,0.0002146289,0.0001619785,0.2923327,0.00003605297,0.00021387,0.002020148,0.01829042,0.5314145],"study_design_scores_gemma":[0.02073596,0.006060625,0.03766919,0.003482586,0.0001034623,0.0002109713,0.5562822,0.3710046,0.0007094679,0.0002132597,0.002586787,0.0009408947],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.984186,0.00001341573,0.00119272,0.0007176125,0.0002919779,0.0009747049,0.00001064626,0.0001276292,0.01248528],"genre_scores_gemma":[0.9814575,5.112415e-7,0.01301741,0.0052695,0.0000927435,0.0001201511,0.00001530316,0.00001804681,0.000008831449],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5304736,"threshold_uncertainty_score":0.9978926,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0326126566069019,"score_gpt":0.3695774006897237,"score_spread":0.3369647440828218,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}