{"id":"W3023509778","doi":"10.18653/v1/2020.acl-main.702","title":"Gender Gap in Natural Language Processing Research: Disparities in Authorship and Citations","year":2020,"lang":"en","type":"preprint","venue":"","topic":"scientometrics and bibliometrics research","field":"Decision Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"National Research Council Canada","funders":"","keywords":"Disadvantaged; Gender gap; Field (mathematics); Gender disparity; Gender bias; Psychology; Demography; Demographic economics; Sociology; Political science; Social psychology; Law; Economics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.01223798,0.0001956284,0.0004146994,0.01186015,0.001104226,0.002810728,0.0004392398,0.0004501049,0.006303806],"category_scores_gemma":[0.07403794,0.0001160749,0.0003762471,0.01695238,0.001181861,0.003496103,0.001994617,0.0004726343,0.001293393],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009149305,"about_ca_system_score_gemma":0.001656139,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003800083,"about_ca_topic_score_gemma":0.007615427,"domain_scores_codex":[0.9921915,0.002055488,0.001371564,0.00134682,0.002562555,0.0004721336],"domain_scores_gemma":[0.9033444,0.05851015,0.02131379,0.004759963,0.01023016,0.001841598],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001630604,0.00005094168,0.8247122,0.0008380929,0.0001788383,0.0003727553,0.01580509,0.0004007692,0.001973095,0.02091908,0.006797801,0.1277884],"study_design_scores_gemma":[0.00001247675,0.00008745938,0.9284399,0.0005079651,0.00007531838,0.0008189112,0.01091438,0.0007623133,0.002386539,0.02016509,0.03578425,0.00004542121],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.940655,0.009943646,0.008150609,0.008181651,0.0003642393,0.00005156536,0.007192428,0.0001127076,0.02534824],"genre_scores_gemma":[0.9908743,0.001731656,0.002375459,0.0005576012,0.0002362526,0.00005055395,0.002139387,0.00005038785,0.001984409],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9881399,"threshold_uncertainty_score":0.06472141,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9217534349266007,"score_gpt":0.6847247130254399,"score_spread":0.2370287219011608,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}