{"id":"W4404518586","doi":"10.1609/aies.v7i1.31616","title":"Understanding Intrinsic Socioeconomic Biases in Large Language Models","year":2024,"lang":"en","type":"article","venue":"Proceedings of the AAAI/ACM Conference on AI Ethics and Society","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; HEC Montréal","funders":"Compute Canada; Natural Sciences and Engineering Research Council of Canada; Canadian Institute for Advanced Research","keywords":"Socioeconomic status; Psychology; Sociology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01588443,0.0006864076,0.0006080333,0.001287128,0.0009222285,0.002746969,0.001039538,0.001036086,0.002569445],"category_scores_gemma":[0.08755694,0.000474462,0.0006889441,0.001063515,0.001676748,0.005197929,0.00315508,0.002196203,0.000818816],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001319387,"about_ca_system_score_gemma":0.001358097,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005398014,"about_ca_topic_score_gemma":0.009216809,"domain_scores_codex":[0.993282,0.005045824,0.0002744883,0.0006597317,0.0005220132,0.0002159365],"domain_scores_gemma":[0.9321774,0.05940683,0.002663383,0.003558427,0.001698665,0.0004952708],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"observational","study_design_scores_codex":[0.000657131,0.0002120911,0.2067866,0.0004799169,0.0005600794,0.0008962018,0.006303106,0.3466636,0.002740842,0.2594084,0.01583023,0.1594618],"study_design_scores_gemma":[0.00003498603,0.00004487612,0.009197907,0.00009710738,0.00004651409,0.0001388735,0.0005318846,0.7281266,0.001011261,0.2558071,0.004922573,0.00004020828],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.51444,0.00119703,0.4601815,0.009519605,0.0001572927,0.0001238057,0.002718351,0.0008764702,0.01078589],"genre_scores_gemma":[0.9663497,0.0002944903,0.02949678,0.0006573984,0.0001358994,0.0001053687,0.001342633,0.0001354254,0.001482395],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01588443,"threshold_uncertainty_score":0.08400589,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2607526196667064,"score_gpt":0.4164921700586259,"score_spread":0.1557395503919195,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}