{"id":"W2740478029","doi":"10.24963/ijcai.2017/413","title":"Obtaining High-Quality Label by Distinguishing between Easy and Hard Items in Crowdsourcing","year":2017,"lang":"en","type":"article","venue":"","topic":"Mobile Crowdsensing and Crowdsourcing","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":true,"ca_institutions":"Novelis (Canada)","funders":"National Key Research and Development Program of China; National Natural Science Foundation of China","keywords":"Crowdsourcing; Quality (philosophy); Computer science; Set (abstract data type); Payment; Construct (python library); Scale (ratio); Machine learning; Artificial intelligence; Data science; Data mining; World Wide Web","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006330214,0.00223604,0.002141438,0.003158908,0.002102552,0.003012834,0.002427145,0.003248496,0.001508503],"category_scores_gemma":[0.03084257,0.0008027109,0.001388751,0.002130111,0.002448579,0.004096389,0.004402699,0.003340137,0.001284809],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001985611,"about_ca_system_score_gemma":0.001730398,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007434715,"about_ca_topic_score_gemma":0.009269795,"domain_scores_codex":[0.9940752,0.001899864,0.0003103427,0.00172194,0.0016092,0.0003834202],"domain_scores_gemma":[0.9789127,0.01263394,0.002401581,0.002854284,0.002256164,0.0009412979],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003042303,0.001598469,0.0743917,0.00151827,0.0005957574,0.001173847,0.005250718,0.2353151,0.0366088,0.02158661,0.01362033,0.605298],"study_design_scores_gemma":[0.0001785569,0.0002534284,0.0134228,0.0001467289,0.0001382368,0.0002672945,0.001040249,0.8889807,0.0132544,0.07534012,0.006764317,0.0002131797],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.181526,0.0006628951,0.8087671,0.001202508,0.0001416246,0.0004996397,0.0006885246,0.001464199,0.00504764],"genre_scores_gemma":[0.7623724,0.0002167336,0.2313862,0.0004511256,0.0001652335,0.0003610948,0.001138375,0.0002434654,0.003665386],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.007434715,"threshold_uncertainty_score":0.03347772,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04632613660003589,"score_gpt":0.3053481823572383,"score_spread":0.2590220457572024,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}