{"id":"W4413807406","doi":"10.1186/s13321-025-01073-6","title":"FusionCLM: enhanced molecular property prediction via knowledge fusion of chemical language models","year":2025,"lang":"en","type":"article","venue":"Journal of Cheminformatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Children’s Health Research Institute; Western University; Lawson Health Research Institute; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Computer science; Property (philosophy); Artificial intelligence; Ensemble learning; Inference; Machine learning; Representation (politics); Feature (linguistics); Feature learning; Deep learning; Data mining","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001208063,0.001443017,0.001401241,0.001866015,0.0003951888,0.001055182,0.002247659,0.001348457,0.001963446],"category_scores_gemma":[0.0034896,0.0005357654,0.001842202,0.001398396,0.0004922886,0.002859949,0.002016668,0.002114017,0.001009695],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001251938,"about_ca_system_score_gemma":0.001882621,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008492187,"about_ca_topic_score_gemma":0.01075718,"domain_scores_codex":[0.9993343,0.0001333165,0.00003479166,0.0001576735,0.0002630618,0.00007692941],"domain_scores_gemma":[0.9991078,0.0004111848,0.0001229615,0.0001488575,0.0001601869,0.00004903465],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002436906,0.0003467432,0.004540039,0.0002258078,0.000312412,0.0002398417,0.0000807715,0.6214088,0.00766311,0.007981999,0.01175749,0.3451993],"study_design_scores_gemma":[0.00000760785,0.00002880624,0.0001082146,0.000004925723,0.00001324865,0.00001714246,0.000004372368,0.9943259,0.00150377,0.003364728,0.0006135568,0.000007595119],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07475719,0.001860877,0.8980836,0.0009088543,0.0001205988,0.0001449278,0.002496023,0.01795104,0.003676964],"genre_scores_gemma":[0.6658366,0.0008778758,0.3212828,0.0009253039,0.0001131802,0.0003464409,0.006566944,0.0005266909,0.003524225],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008492187,"threshold_uncertainty_score":0.01688546,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.009688278155474715,"score_gpt":0.2810880372370465,"score_spread":0.2713997590815717,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}