{"id":"W1599355180","doi":"10.1109/icse.2012.6227189","title":"Test confessions: A study of testing practices for plug-in systems","year":2012,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":37,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Victoria","funders":"","keywords":"Test strategy; Computer science; Eclipse; Unit testing; Integration testing; Plug-in; Set (abstract data type); Test (biology); Software engineering; White-box testing; Limiting; Key (lock); Engineering; Operating system; Programming language; Software; Software system; Software construction","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.001113261,0.00006083849,0.000119315,0.0001236947,0.00003179868,0.00005363886,0.0004123758,0.00002465407,0.000002367778],"category_scores_gemma":[0.01609646,0.00004844902,0.00001031327,0.0004163459,0.000007371274,0.0004999364,0.0001516981,0.00007968951,0.000008605478],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002620354,"about_ca_system_score_gemma":0.00005127956,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005465166,"about_ca_topic_score_gemma":0.00001251106,"domain_scores_codex":[0.9991279,0.00004264538,0.0001947509,0.0001453163,0.0002280562,0.0002613928],"domain_scores_gemma":[0.9877992,0.01155507,0.0001271228,0.000318893,0.0001351955,0.0000644586],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000001520198,0.0006670986,0.9946108,0.00007960235,0.000006575952,0.00000170621,0.0008615484,0.0003759337,0.0005224679,0.00124189,0.0001393453,0.00149148],"study_design_scores_gemma":[0.001824066,0.001337676,0.6717457,0.0002670918,0.000009644202,0.00002860752,0.003228775,0.3192933,0.0008690939,0.00003872238,0.001026968,0.000330328],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8271022,0.0003036176,0.1697429,0.00007906961,0.0005131327,0.001339661,0.000001106086,0.0002350052,0.0006832651],"genre_scores_gemma":[0.9725038,4.100122e-7,0.02707655,0.000003951096,0.00004628541,0.0001422456,1.15315e-7,0.000005910614,0.0002206697],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3228651,"threshold_uncertainty_score":0.9921914,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1614351616850639,"score_gpt":0.3923715735112349,"score_spread":0.230936411826171,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}