{"id":"W2531425405","doi":"10.1007/s10664-016-9456-2","title":"Which log level should developers choose for a new logging statement?","year":2016,"lang":"en","type":"article","venue":"Empirical Software Engineering","topic":"Software System Performance and Reliability","field":"Computer Science","cited_by":107,"is_retracted":false,"has_abstract":false,"ca_institutions":"Concordia University; Queen's University","funders":"","keywords":"Statement (logic); Logging; Computer science; Brier score; Leverage (statistics); Login; Database; Data mining; Information retrieval; Operating system; Machine learning; Forestry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.008143733,0.0002944368,0.0002919412,0.000998745,0.0005188838,0.001698208,0.0006490369,0.001254261,0.004732789],"category_scores_gemma":[0.09121022,0.0004232149,0.0002866578,0.0005140971,0.0006998166,0.003073175,0.0006072848,0.001392272,0.001838258],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007618146,"about_ca_system_score_gemma":0.001491885,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002211501,"about_ca_topic_score_gemma":0.009467151,"domain_scores_codex":[0.9958662,0.001645915,0.0003938384,0.0006092099,0.001035364,0.0004495366],"domain_scores_gemma":[0.9215124,0.04864463,0.01010276,0.005220728,0.009682205,0.004837272],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001928629,0.001183169,0.6853866,0.000482137,0.0001823653,0.0008978263,0.00351067,0.001864639,0.01687762,0.004213073,0.01807809,0.2653952],"study_design_scores_gemma":[0.0006321674,0.002066515,0.8243482,0.000847475,0.0005696043,0.002096843,0.02409402,0.03514585,0.03728324,0.03256024,0.03995826,0.0003976187],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9616467,0.000361596,0.01399364,0.00962304,0.000122808,0.0001534964,0.0007853953,0.0006566903,0.01265661],"genre_scores_gemma":[0.9881621,0.000119133,0.008767188,0.0005837741,0.00003552836,0.00004485624,0.0001843526,0.000143524,0.001959507],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9918563,"threshold_uncertainty_score":0.04306871,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07458787435700132,"score_gpt":0.3073065049729828,"score_spread":0.2327186306159815,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}