{"id":"W4411170938","doi":"10.2196/72771","title":"Using Natural Language Processing to Describe the Use of an Online Community for Abortion During 2022: Dynamic Topic Modeling Analysis of Reddit Posts","year":2025,"lang":"en","type":"article","venue":"JMIR Infodemiology","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Preprint; Abortion; Computer science; Data science; World Wide Web; Pregnancy; Biology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003734063,0.0005508909,0.0003665422,0.005179413,0.000833882,0.002135449,0.0008412168,0.001022327,0.001302121],"category_scores_gemma":[0.01273287,0.0002681879,0.001410005,0.003898115,0.0007010037,0.002360557,0.0009744861,0.00137999,0.0006287262],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001991606,"about_ca_system_score_gemma":0.001196522,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02781758,"about_ca_topic_score_gemma":0.03631917,"domain_scores_codex":[0.9982473,0.0007678131,0.0001738666,0.0004370405,0.0002197427,0.0001542659],"domain_scores_gemma":[0.9781497,0.01895891,0.001423435,0.0004755271,0.0007448157,0.0002476419],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001398539,0.001200364,0.5572481,0.001588913,0.0006340671,0.002791526,0.03949957,0.08958655,0.01491846,0.0211954,0.02628088,0.2436576],"study_design_scores_gemma":[0.00005424349,0.0002172695,0.2055091,0.0002397536,0.0001709631,0.0007119403,0.01855089,0.728372,0.003697565,0.01482703,0.02748446,0.0001648994],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.895547,0.001008068,0.07338443,0.00266039,0.0001256786,0.0005283699,0.02129555,0.0006851662,0.004765483],"genre_scores_gemma":[0.9367321,0.000299493,0.04176531,0.0001648339,0.00009845818,0.0006610167,0.01861917,0.00007129509,0.001588408],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02781758,"threshold_uncertainty_score":0.05531132,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2037874939114793,"score_gpt":0.5023566003933344,"score_spread":0.2985691064818551,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}