{"id":"W2901899013","doi":"10.1016/j.envpol.2018.11.034","title":"Evaluation of random forest regression and multiple linear regression for predicting indoor fine particulate matter concentrations in a highly polluted city","year":2018,"lang":"en","type":"article","venue":"Environmental Pollution","topic":"Air Quality Monitoring and Forecasting","field":"Environmental Science","cited_by":158,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Waterloo; BC Centre for Disease Control; Simon Fraser University","funders":"Canadian Institutes of Health Research","keywords":"Particulates; Linear regression; Environmental science; Regression analysis; Regression dilution; Regression; Random forest; Statistics; Bayesian multivariate linear regression; Mathematics; Ecology; Computer science; Machine learning; Biology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01887576,0.002053776,0.002033712,0.001680607,0.0006167937,0.001078393,0.001679019,0.001572075,0.000989329],"category_scores_gemma":[0.0185126,0.0005346179,0.001342143,0.0008236262,0.0003961108,0.001494153,0.0007823167,0.0009667791,0.00035065],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00107183,"about_ca_system_score_gemma":0.001753824,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0409876,"about_ca_topic_score_gemma":0.01661845,"domain_scores_codex":[0.9963193,0.002350152,0.0002598609,0.0004908074,0.0003613792,0.0002184591],"domain_scores_gemma":[0.9765981,0.01922456,0.0004687458,0.0004475788,0.002879326,0.0003817456],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.007169805,0.001610613,0.03875542,0.0003339417,0.0007442374,0.0001859781,0.00009448842,0.7419737,0.004052429,0.0005064083,0.001528688,0.2030443],"study_design_scores_gemma":[0.00007979925,0.0003056781,0.002532408,0.000005152185,0.00008179134,0.00001109658,0.00002335566,0.9960013,0.0008237111,0.00006356771,0.00006232917,0.000009858549],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9123513,0.002011129,0.08034463,0.0003981191,0.0001940377,0.0002333212,0.0006288574,0.001785088,0.002053629],"genre_scores_gemma":[0.959234,0.0002479294,0.03867467,0.00005518333,0.00004584515,0.00008745308,0.0007759949,0.00008117576,0.00079772],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0409876,"threshold_uncertainty_score":0.09982574,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03490814752223052,"score_gpt":0.2868460557212793,"score_spread":0.2519379081990488,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}