{"id":"W4408253036","doi":"10.1016/j.jenvman.2025.124803","title":"Effect of training sample size, image resolution and epochs on filamentous and floc-forming bacteria classification using machine learning","year":2025,"lang":"en","type":"article","venue":"Journal of Environmental Management","topic":"Smart Agriculture and AI","field":"Agricultural and Biological Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"Suez (Canada); McMaster University","funders":"Global Water Futures; Natural Sciences and Engineering Research Council of Canada","keywords":"Sample (material); Artificial intelligence; Resolution (logic); Bacteria; Training (meteorology); Pattern recognition (psychology); Computer vision; Computer science; Biology; Chemistry; Chromatography; Geography","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003407588,0.001057506,0.0005978565,0.0003825352,0.0002978284,0.0007855386,0.0005677327,0.001060493,0.0007585685],"category_scores_gemma":[0.01184968,0.0003254675,0.0005594341,0.0003820779,0.0006850669,0.001289952,0.000518848,0.0009278728,0.0002239513],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004472875,"about_ca_system_score_gemma":0.0009096292,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00387594,"about_ca_topic_score_gemma":0.003039301,"domain_scores_codex":[0.9994036,0.0001667644,0.00007185936,0.0001407091,0.0001262386,0.00009081778],"domain_scores_gemma":[0.9954512,0.003104497,0.0003106857,0.0004018077,0.0005921616,0.0001397183],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003900149,0.001045069,0.02900598,0.0005491129,0.000300334,0.0006240134,0.0003840169,0.6322317,0.06529891,0.001184411,0.002213029,0.2632633],"study_design_scores_gemma":[0.0001269969,0.001227331,0.01970551,0.0001578769,0.0002201184,0.0001851631,0.0001947898,0.8931609,0.08226272,0.001083311,0.001608673,0.00006666359],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9532184,0.001594143,0.04083191,0.0004655561,0.000186625,0.0001162563,0.0001598853,0.001264352,0.002162834],"genre_scores_gemma":[0.9645104,0.0004565499,0.03365634,0.0002079896,0.0000242412,0.00008736555,0.0002712651,0.0001185191,0.0006673125],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.00387594,"threshold_uncertainty_score":0.01802123,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01051894083327664,"score_gpt":0.2157013919162435,"score_spread":0.2051824510829668,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}