{"id":"W2955854775","doi":"10.1007/s10664-019-09733-6","title":"Identifying gameplay videos that exhibit bugs in computer games","year":2019,"lang":"en","type":"article","venue":"Empirical Software Engineering","topic":"Digital Games and Media","field":"Social Sciences","cited_by":22,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Alberta; Queen's University","funders":"","keywords":"Computer science; Metadata; Context (archaeology); Game Developer; Quality (philosophy); Classifier (UML); Multimedia; World Wide Web; Information retrieval; Human–computer interaction; Artificial intelligence; Game design","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003150024,0.0001545462,0.0002524004,0.0001253109,0.00002966452,0.0001728046,0.0002535918,0.0001227508,0.0002373114],"category_scores_gemma":[0.0003036731,0.0001538485,0.000101299,0.000342647,0.00003884096,0.000409079,0.0001005142,0.00023273,0.0002963878],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001478314,"about_ca_system_score_gemma":0.0000542687,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00008469295,"about_ca_topic_score_gemma":0.00007165162,"domain_scores_codex":[0.9985321,0.00002897886,0.0001991839,0.0003038482,0.0004102483,0.0005256775],"domain_scores_gemma":[0.9991732,0.0003836178,0.00003689369,0.0001808762,0.00002353465,0.0002018253],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000007457043,0.00006357957,0.8983442,0.00008114099,0.00002031867,0.00005152255,0.01098032,0.004660797,0.00003738458,0.0003792357,0.002542985,0.08283102],"study_design_scores_gemma":[0.0005199689,0.00004380701,0.1594824,0.0003456166,0.000006888813,0.000003458176,0.0004479765,0.001540404,0.0001175741,0.0001156242,0.8368788,0.0004974795],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9668877,0.0003552158,0.02488929,0.0004459812,0.001746655,0.0003330667,0.000003835348,0.0005055622,0.004832655],"genre_scores_gemma":[0.9913955,0.00003171006,0.003896284,0.0004179259,0.0004126363,0.00001445905,0.000005048626,0.00003121488,0.003795183],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8343358,"threshold_uncertainty_score":0.6273758,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0285645952500537,"score_gpt":0.2942501658445961,"score_spread":0.2656855705945424,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}