{"id":"W4416421739","doi":"10.1093/bib/bbaf611","title":"Precision in prediction: tailoring machine learning models for breast cancer missense variants pathogenicity prediction","year":2025,"lang":"en","type":"article","venue":"Briefings in Bioinformatics","topic":"Genomics and Rare Diseases","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"United Arab Emirates University","keywords":"Interpretability; Benchmarking; Breast cancer; Pathogenicity; Precision medicine; Feature (linguistics); Robustness (evolution); Dimensionality reduction","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008930921,0.001456074,0.001074356,0.001360578,0.0005051187,0.001672401,0.001222127,0.001396623,0.0008924889],"category_scores_gemma":[0.02799588,0.0004253788,0.001091104,0.00102488,0.0005489803,0.001552684,0.001590357,0.002588099,0.0006522475],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008086482,"about_ca_system_score_gemma":0.001222315,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00454884,"about_ca_topic_score_gemma":0.004780587,"domain_scores_codex":[0.9968694,0.001577904,0.000194421,0.0007332893,0.000438881,0.0001861637],"domain_scores_gemma":[0.9858839,0.01088188,0.0006833346,0.001283578,0.001088438,0.000178915],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006604492,0.0001820371,0.05411977,0.0002337166,0.0004840002,0.0002442101,0.0002174012,0.7347773,0.003900806,0.002312012,0.004993102,0.1978753],"study_design_scores_gemma":[0.00002995032,0.0001120622,0.002960889,0.0000403069,0.00007394431,0.00006925212,0.00003492405,0.9880708,0.002448753,0.005316828,0.0008213332,0.0000208159],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.4717475,0.005054307,0.5077072,0.002138682,0.0002440115,0.0001667537,0.00209061,0.006738745,0.004112103],"genre_scores_gemma":[0.9328287,0.0004815173,0.06299569,0.0004097574,0.0001087847,0.0000767968,0.002162111,0.000241943,0.0006946604],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.008930921,"threshold_uncertainty_score":0.04723179,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01136543101514288,"score_gpt":0.237825636749706,"score_spread":0.2264602057345631,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}