{"id":"W2171494278","doi":"","title":"Software testing by active learning for commercial games","year":2005,"lang":"en","type":"article","venue":"National Conference on Artificial Intelligence","topic":"Software Testing and Debugging Techniques","field":"Computer Science","cited_by":22,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo; University of Alberta","funders":"","keywords":"Computer science; Correctness; Video game; Context (archaeology); Software engineering; Software performance testing; Artificial intelligence; White-box testing; Software; Active learning (machine learning); Machine learning; Human–computer interaction; Software construction; Software system; Multimedia; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003443301,0.000928541,0.0007636772,0.001118103,0.0005558078,0.001658311,0.002081011,0.001218422,0.002631339],"category_scores_gemma":[0.01792387,0.0005376514,0.0007072483,0.0006846237,0.001554363,0.002629817,0.001647804,0.001581813,0.0003909253],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001462862,"about_ca_system_score_gemma":0.0009453083,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004341784,"about_ca_topic_score_gemma":0.004434096,"domain_scores_codex":[0.9969431,0.001629799,0.000134203,0.0003530706,0.0007654254,0.0001744574],"domain_scores_gemma":[0.9817719,0.01500123,0.0006155309,0.001477088,0.0009026655,0.0002314971],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005484223,0.0006631729,0.004995409,0.0001895347,0.00008383315,0.0002224691,0.0003996386,0.6073303,0.008224253,0.03636452,0.002576827,0.3384016],"study_design_scores_gemma":[0.00001115024,0.00002399976,0.0001154219,0.000003344444,0.000002370141,0.00001229497,0.0000077022,0.9914929,0.001381557,0.006644755,0.0003012471,0.000003117602],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.06956089,0.0002396179,0.9232528,0.0004333349,0.00002449607,0.0001507579,0.0000625362,0.00343945,0.00283617],"genre_scores_gemma":[0.7371759,0.00008410562,0.2606941,0.0000995688,0.00002046934,0.0002391659,0.0001283752,0.0001944123,0.001363886],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.004341784,"threshold_uncertainty_score":0.01821011,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1677952999861552,"score_gpt":0.367221644746226,"score_spread":0.1994263447600709,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}