{"id":"W2056488032","doi":"10.1145/1391984.1391985","title":"Unit-level test adequacy criteria for visual dataflow languages and a testing methodology","year":2008,"lang":"en","type":"article","venue":"ACM Transactions on Software Engineering and Methodology","topic":"Software Testing and Debugging Techniques","field":"Computer Science","cited_by":92,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Dataflow; Context (archaeology); Unit testing; Visual programming language; Empirical research; Software engineering; Programming language; Software","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01072826,0.0009186876,0.0007564116,0.006618063,0.0006563935,0.001936338,0.00150203,0.001514522,0.001749335],"category_scores_gemma":[0.08693962,0.0003997194,0.001073803,0.001817541,0.00213775,0.002496471,0.001566842,0.0009339405,0.0002209674],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001277839,"about_ca_system_score_gemma":0.001490789,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001815057,"about_ca_topic_score_gemma":0.001851716,"domain_scores_codex":[0.9824097,0.008039705,0.001972932,0.0009765016,0.006048907,0.0005523178],"domain_scores_gemma":[0.8961833,0.08041725,0.006704325,0.004858478,0.01072586,0.001110794],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001181941,0.0009115228,0.07097267,0.001148968,0.0002697564,0.001300904,0.0018657,0.2241284,0.07255206,0.143042,0.00284731,0.4797787],"study_design_scores_gemma":[0.0001184743,0.0008818285,0.007116665,0.0001974844,0.00008042854,0.001019636,0.0004082145,0.9051265,0.038119,0.04430988,0.002561794,0.00006020431],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0924143,0.0002220898,0.9037453,0.0001838755,0.0000123966,0.0002551624,0.0001053,0.0007693805,0.002292308],"genre_scores_gemma":[0.6517582,0.00005791319,0.3469537,0.00008101921,0.00002330335,0.00041348,0.0002457433,0.000115079,0.0003515071],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01072826,"threshold_uncertainty_score":0.05673712,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3232977272659157,"score_gpt":0.4163952044641103,"score_spread":0.09309747719819456,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}