{"id":"W2952297896","doi":"10.1016/j.envint.2019.104934","title":"A comparison of linear regression, regularization, and machine learning algorithms to develop Europe-wide spatial models of fine particles and nitrogen dioxide","year":2019,"lang":"en","type":"article","venue":"Environment International","topic":"Air Quality and Health Impacts","field":"Environmental Science","cited_by":338,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"China Scholarship Council; Medical Research Council; Health Effects Institute; U.S. Environmental Protection Agency","keywords":"Linear regression; Algorithm; Support vector machine; Random forest; Artificial neural network; Stepwise regression; Machine learning; Mathematics; Regression analysis; Statistics; Linear model; Artificial intelligence; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007953702,0.0009446245,0.0007427219,0.001127082,0.0004947553,0.0008808564,0.001097419,0.001001684,0.001343425],"category_scores_gemma":[0.01321077,0.0003631049,0.001497624,0.001119733,0.0003167493,0.001119338,0.0009553382,0.00131315,0.0004167276],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008740878,"about_ca_system_score_gemma":0.002028538,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02284628,"about_ca_topic_score_gemma":0.02078033,"domain_scores_codex":[0.9978704,0.001437691,0.0001355691,0.0002332795,0.0002311002,0.00009182805],"domain_scores_gemma":[0.9945177,0.003888788,0.0001984969,0.0003684101,0.0009391559,0.00008738718],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002468869,0.0002676564,0.006669147,0.00009565505,0.0004552936,0.00004143699,0.00006605693,0.8681183,0.0009711912,0.008078547,0.00227677,0.1127131],"study_design_scores_gemma":[0.00002475699,0.00004751005,0.0007353506,0.00001151357,0.00003408429,0.00001143289,0.0000150841,0.9966854,0.000403523,0.001461055,0.0005591388,0.00001111481],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.192268,0.002053885,0.7942948,0.001559441,0.0002490621,0.0002022149,0.0004705679,0.00149353,0.007408383],"genre_scores_gemma":[0.5422181,0.0007946235,0.4502987,0.0003991775,0.0000860986,0.0002670548,0.001145147,0.0005046038,0.004286387],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02284628,"threshold_uncertainty_score":0.04542661,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0412298700638622,"score_gpt":0.2957456222841378,"score_spread":0.2545157522202756,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}