{"id":"W4205572831","doi":"10.1109/bigdata52589.2021.9671347","title":"Forecasting Air Pollution using a Modified Compositional Learning Approach","year":2021,"lang":"en","type":"article","venue":"2021 IEEE International Conference on Big Data (Big Data)","topic":"Air Quality Monitoring and Forecasting","field":"Environmental Science","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"Carleton University","funders":"","keywords":"Random forest; Air quality index; Hyperparameter; Artificial intelligence; Set (abstract data type); Linear regression; Machine learning; Computer science; Air pollution; Mean squared error; Regression; Statistics; Mathematics; Meteorology; Chemistry; Geography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002104097,0.001087425,0.001471913,0.001652726,0.0004999666,0.001059491,0.002117655,0.00137714,0.001978025],"category_scores_gemma":[0.004299706,0.00064045,0.00158153,0.001297405,0.0005118403,0.001185519,0.001039965,0.001057778,0.0004409639],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008030958,"about_ca_system_score_gemma":0.001440382,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02529738,"about_ca_topic_score_gemma":0.01762711,"domain_scores_codex":[0.9992334,0.0002494853,0.00005891895,0.0002274772,0.0001454014,0.00008532007],"domain_scores_gemma":[0.998269,0.0009776399,0.000154815,0.0001152628,0.0004156198,0.00006760346],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00009521159,0.00008516841,0.002123311,0.00004566603,0.0001284763,0.00004758984,0.00001845865,0.9565603,0.0008488367,0.001176049,0.0003136541,0.03855722],"study_design_scores_gemma":[0.000003279151,0.00000674412,0.00007443594,0.000001128523,0.000004766879,0.000001434365,9.523399e-7,0.9994946,0.0000610061,0.0003161674,0.00003408443,0.000001470026],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1378589,0.0009705016,0.8558063,0.0004465676,0.0001514702,0.0001772543,0.000483616,0.001064568,0.003040918],"genre_scores_gemma":[0.8433874,0.0003822342,0.1518864,0.0002534058,0.0001763252,0.0001952665,0.0009321776,0.0000803197,0.00270665],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02529738,"threshold_uncertainty_score":0.05030024,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4993754370384956,"score_gpt":0.3612890250771909,"score_spread":0.1380864119613047,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}