{"id":"W4319865064","doi":"10.2139/ssrn.4329633","title":"Long-Term Evaluation of Machine Learning Based Methods for Air Emission Monitoring","year":2023,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Air Quality Monitoring and Forecasting","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Overfitting; Mean squared error; Machine learning; Artificial neural network; Term (time); Computer science; Artificial intelligence; Audit; Algorithm; Gradient boosting; Statistics; Mathematics; Accounting; Random forest","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01155232,0.001132664,0.0008476534,0.001362454,0.0005712106,0.001185998,0.001016172,0.001771051,0.0008973163],"category_scores_gemma":[0.02042169,0.0002088976,0.0007156187,0.001036417,0.0005076659,0.001402221,0.0009838294,0.0009652784,0.0003706206],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001077994,"about_ca_system_score_gemma":0.0005731196,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008207613,"about_ca_topic_score_gemma":0.006276299,"domain_scores_codex":[0.9965005,0.001588525,0.0002939758,0.0005769563,0.0009086006,0.0001313816],"domain_scores_gemma":[0.9765553,0.0157978,0.001504753,0.001273779,0.004477242,0.0003910357],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.009664726,0.003905858,0.09514525,0.0009288238,0.001775027,0.000243382,0.0003078151,0.4745432,0.01898957,0.0009327437,0.003090622,0.3904729],"study_design_scores_gemma":[0.0001255368,0.003563726,0.04304885,0.00006335799,0.000360407,0.0001207705,0.000108431,0.9375761,0.01327639,0.00054328,0.001135516,0.00007763968],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9605747,0.0044815,0.03096894,0.000353775,0.0003118293,0.0001333959,0.0008934084,0.0003587138,0.001923696],"genre_scores_gemma":[0.9844077,0.0005646255,0.01143192,0.00006814968,0.0001062574,0.00007991278,0.001786913,0.0000514516,0.001503103],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01155232,"threshold_uncertainty_score":0.06109524,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06030866881905409,"score_gpt":0.3916659271384849,"score_spread":0.3313572583194307,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}