{"id":"W7130675486","doi":"10.1109/swc65939.2025.00307","title":"Generating Synthetic Categorical Data for Causal Modelling of Accessibility Barriers","year":2025,"lang":"","type":"article","venue":"","topic":"Disability Rights and Representation","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Categorical variable; Statistical model; Bayesian network; Generative grammar; Synthetic data; Probabilistic logic; Copula (linguistics); Causal model; Data modeling; Bayesian probability","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002455198,0.0001743233,0.0003935975,0.00006467407,0.0009578157,0.0002171352,0.001065895,0.0002125478,0.0005700028],"category_scores_gemma":[0.001045916,0.0001314865,0.0001365294,0.0005116583,0.001163005,0.0006752706,0.000367004,0.0001268904,0.00000194627],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001216012,"about_ca_system_score_gemma":0.001157424,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007369844,"about_ca_topic_score_gemma":0.001690955,"domain_scores_codex":[0.9970632,0.0003510354,0.0008555235,0.0009208481,0.0004057216,0.0004036631],"domain_scores_gemma":[0.9973944,0.0008411689,0.0001959854,0.001093686,0.0003003812,0.000174372],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002357123,0.0008398627,0.007037135,0.001277992,0.0003770096,9.32126e-7,0.01476467,0.1156874,0.0008031045,0.8228412,0.003312374,0.03282255],"study_design_scores_gemma":[0.0002740338,0.0000287952,0.00003460968,0.00003252098,0.0001692259,7.1432e-8,0.009491626,0.9208547,0.0006586151,0.0666738,0.001618207,0.0001638047],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1313372,0.0003088231,0.8389263,0.004413371,0.001623079,0.001452865,0.0001600519,0.00004226765,0.02173615],"genre_scores_gemma":[0.9913137,0.00007250281,0.004936249,0.00006113879,0.000178525,0.00002016433,0.00004812284,0.000007768402,0.003361804],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8599766,"threshold_uncertainty_score":0.9992402,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1279443924268044,"score_gpt":0.4034514060749615,"score_spread":0.2755070136481572,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}