{"id":"W3181437774","doi":"","title":"Automatic Test Suite Generation for Key-Points Detection DNNs using Many-Objective Search (Experience Paper)","year":2021,"lang":"en","type":"preprint","venue":"Open Repository and Bibliography (University of Luxembourg)","topic":"Autonomous Vehicle Technology and Safety","field":"Engineering","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada; National Research Foundation of Korea; Fonds National de la Recherche Luxembourg; National Research Foundation; European Commission","keywords":"Computer science; Key (lock); Artificial intelligence; Suite; Machine learning; Test suite; Data mining; Pattern recognition (psychology); Test case","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0003078814,0.0002550191,0.0004457263,0.003308558,0.0007117637,0.0002220096,0.0004910947,0.0005112111,0.00003182972],"category_scores_gemma":[0.000002772329,0.0003309773,0.0002317672,0.002753062,0.0002433706,0.0006927234,0.0006171874,0.000450525,5.167271e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006070929,"about_ca_system_score_gemma":0.00007071336,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000637884,"about_ca_topic_score_gemma":0.0001093469,"domain_scores_codex":[0.9987275,0.00008798916,0.0002406559,0.0005238467,0.0001606652,0.0002593407],"domain_scores_gemma":[0.9990811,0.00009844256,0.000158068,0.0003970508,0.0001755262,0.00008982724],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002174085,0.000701273,0.1549273,0.004389124,0.002773339,0.0003915704,0.01749149,0.0160997,0.7651709,0.00052209,0.0005171722,0.03679862],"study_design_scores_gemma":[0.00153027,0.000341539,0.1097396,0.0006682096,0.000566944,0.0001775632,0.01009596,0.7645863,0.1102668,0.0003849197,0.0003369019,0.001305058],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9379115,0.0005347142,0.05946795,0.00002676929,0.000303491,0.0009250129,0.00004138687,0.000196704,0.000592515],"genre_scores_gemma":[0.9898495,0.0009063791,0.009059066,0.000009523605,0.00006061869,0.00001199892,0.00003175946,0.0000247128,0.00004643277],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7484866,"threshold_uncertainty_score":0.9999142,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02348353678583482,"score_gpt":0.2386494931221925,"score_spread":0.2151659563363577,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}