{"id":"W4380686180","doi":"10.1021/acs.est.3c00334","title":"The Bigger Fish: A Comparison of Meta-Learning QSAR Models on Low-Resourced Aquatic Toxicity Regression Tasks","year":2023,"lang":"en","type":"article","venue":"Environmental Science & Technology","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":40,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Quantitative structure–activity relationship; Computer science; Machine learning; Benchmark (surveying); Task (project management); Artificial intelligence; Random forest; Applicability domain; Aquatic toxicology; Resource (disambiguation); Toxicity; Chemistry; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001733548,0.0001980599,0.0003301548,0.000602724,0.0008020193,0.00008343688,0.002243535,0.0000992362,0.00001222873],"category_scores_gemma":[0.0002954834,0.0001320936,0.0001178568,0.002632419,0.001545995,0.0004023502,0.001502029,0.0003935513,0.000086566],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001813454,"about_ca_system_score_gemma":0.00005517128,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000007968158,"about_ca_topic_score_gemma":0.000002602928,"domain_scores_codex":[0.9971823,0.0002171415,0.0003875116,0.0006648498,0.001036807,0.0005113593],"domain_scores_gemma":[0.99823,0.0006350226,0.0002756732,0.0007710162,0.000009619022,0.00007865619],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000196764,0.0002515479,0.001042994,0.000006545301,0.00006562234,0.00001016934,0.001498229,0.7928995,0.08921777,0.03122342,0.0002134894,0.08355106],"study_design_scores_gemma":[0.000134249,0.0001945861,0.00191106,0.00001641208,0.0000173907,0.000004462965,0.0004394477,0.878442,0.1000021,0.01803591,0.0006518665,0.0001505175],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9307976,0.00009714159,0.06503651,0.003081065,0.0001513657,0.0002263134,0.000003181074,0.0002686061,0.0003382014],"genre_scores_gemma":[0.9922127,0.00002355571,0.007458135,0.00009427138,0.000007724835,0.00004039969,0.0000022533,0.000009773694,0.000151246],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.08554257,"threshold_uncertainty_score":0.6168565,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04079153206223687,"score_gpt":0.3140982521139617,"score_spread":0.2733067200517248,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}