{"id":"W2266424003","doi":"10.1145/2739999.2740001","title":"Problem with Cross-Cultural Comparison of User-Generated Ratings on Mechanical Turk","year":2015,"lang":"en","type":"article","venue":"","topic":"Cultural Differences and Values","field":"Psychology","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"National Tsing Hua University; University of Washington","keywords":"Collectivism; Style (visual arts); Cross-cultural; Affect (linguistics); Product (mathematics); Psychology; Cultural diversity; Individualism; Social psychology; Uncertainty avoidance; Filter (signal processing); Hofstede's cultural dimensions theory; Cultural bias; Computer science; Sociology; Political science; Mathematics; Geography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0688327,0.001215779,0.001430724,0.003081145,0.002441289,0.00391836,0.001910794,0.001137822,0.005223237],"category_scores_gemma":[0.2879859,0.0005299637,0.001201781,0.004759957,0.002446789,0.002262836,0.003449795,0.00168723,0.002490516],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001319604,"about_ca_system_score_gemma":0.001060706,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008046144,"about_ca_topic_score_gemma":0.00849297,"domain_scores_codex":[0.8378041,0.1100827,0.01257896,0.01404434,0.02407426,0.001415621],"domain_scores_gemma":[0.7373463,0.1525859,0.02105401,0.03518001,0.05182977,0.00200406],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002516185,0.001281446,0.4807652,0.006691723,0.005276673,0.001423476,0.06695527,0.003044419,0.008103246,0.02353817,0.08575417,0.31465],"study_design_scores_gemma":[0.00038777,0.001002517,0.8024747,0.003688608,0.000832643,0.001623053,0.04720927,0.008125633,0.006248552,0.02807575,0.09986465,0.0004667084],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7173944,0.006434266,0.1227289,0.007736255,0.009019992,0.006923044,0.01208909,0.0007542504,0.1169199],"genre_scores_gemma":[0.9454399,0.0007497208,0.030132,0.004560189,0.0009542311,0.008859517,0.003914516,0.0003685844,0.005021408],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9311673,"threshold_uncertainty_score":0.3640265,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2008900948430002,"score_gpt":0.4474751713431908,"score_spread":0.2465850765001906,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}