{"id":"W2125507422","doi":"10.5054/tq.2010.222215","title":"Do Language Proficiency Test Scores Differ by Gender?","year":2010,"lang":"en","type":"article","venue":"TESOL Quarterly","topic":"EFL/ESL Teaching and Learning","field":"Arts and Humanities","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"Thompson Rivers University","funders":"","keywords":"Psychology; Test (biology); Language assessment; Language proficiency; Linguistics; Mathematics education","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007630105,0.0004663195,0.0009579819,0.00182449,0.0003305316,0.001280919,0.001097769,0.001035726,0.006058906],"category_scores_gemma":[0.03488053,0.0002332377,0.001631311,0.002292517,0.001217956,0.002019837,0.0008916788,0.0006040276,0.001586581],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004363296,"about_ca_system_score_gemma":0.0004787552,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003573169,"about_ca_topic_score_gemma":0.003601926,"domain_scores_codex":[0.9948381,0.001233001,0.000750058,0.001330457,0.001324553,0.0005237582],"domain_scores_gemma":[0.9796129,0.01107761,0.005749729,0.001147438,0.001758233,0.0006540247],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000449029,0.00005316546,0.9542782,0.0002402793,0.0007741304,0.0002120958,0.0009407183,0.00007565486,0.0002784895,0.0004635156,0.002503602,0.03973127],"study_design_scores_gemma":[0.00003719798,0.0002925918,0.9920183,0.0001804319,0.0002985744,0.000667245,0.001215974,0.0001738328,0.0002854254,0.001923691,0.002880387,0.00002636922],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9677266,0.01086496,0.002203676,0.003949175,0.0006278299,0.00007139494,0.005309237,0.00006588278,0.009181143],"genre_scores_gemma":[0.9960808,0.0008477471,0.0002107826,0.0006677383,0.0001138348,0.00003553498,0.001208602,0.00002437571,0.0008105546],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.007630105,"threshold_uncertainty_score":0.04035234,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01560257194511426,"score_gpt":0.2436205360457356,"score_spread":0.2280179641006214,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}