{"id":"W3126633874","doi":"10.1145/3437479.3437483","title":"ACM SIGSOFT Empirical Standards Released","year":2021,"lang":"en","type":"article","venue":"ACM SIGSOFT Software Engineering Notes","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":52,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Empirical research; Computer science; Task (project management); Quality (philosophy); Engineering; Systems engineering; Statistics; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05800818,0.001578185,0.001598527,0.0219897,0.002938159,0.01324832,0.00468292,0.00319324,0.2220223],"category_scores_gemma":[0.2960684,0.002033023,0.001791297,0.02435139,0.001497015,0.00922285,0.007962096,0.005618401,0.1887583],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005223698,"about_ca_system_score_gemma":0.02959718,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01689551,"about_ca_topic_score_gemma":0.01293275,"domain_scores_codex":[0.9289047,0.0152643,0.00994856,0.003736083,0.04039503,0.001751418],"domain_scores_gemma":[0.6654512,0.07131858,0.01198768,0.05723667,0.1863242,0.007681767],"domain_codex":null,"domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00007368229,0.0000970218,0.001070741,0.0003991551,0.00002132229,0.00001940493,0.0001766232,0.0002991325,0.0001242314,0.01164405,0.8500126,0.136062],"study_design_scores_gemma":[0.00004901496,0.00003273359,0.002180799,0.0007758249,0.00001661327,0.00004300206,0.0002091457,0.0003672572,0.0001820111,0.0100211,0.986088,0.00003445934],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"other","genre_gemma":"methods","genre_scores_codex":[0.003338358,0.005544749,0.1266738,0.04115677,0.01519017,0.005403373,0.2296883,0.0454522,0.5275522],"genre_scores_gemma":[0.02597569,0.008444903,0.1980423,0.01068349,0.003122309,0.01149803,0.4165897,0.02732556,0.298318],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9419918,"threshold_uncertainty_score":0.7427387,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5303859496964192,"score_gpt":0.4933538232445762,"score_spread":0.03703212645184295,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}