{"id":"W2946345509","doi":"10.1016/j.artmed.2019.05.002","title":"Combining clustering and classification ensembles: A novel pipeline to identify breast cancer profiles","year":2019,"lang":"en","type":"article","venue":"Artificial Intelligence in Medicine","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":38,"is_retracted":false,"has_abstract":false,"ca_institutions":"Ontario Institute for Cancer Research","funders":"Medical Research Council; University of Nottingham","keywords":"Cluster analysis; Computer science; Ensemble learning; Breast cancer; Artificial intelligence; Consensus clustering; Pipeline (software); Robustness (evolution); Statistical classification; Machine learning; Data mining; Pattern recognition (psychology); Cancer; Correlation clustering; CURE data clustering algorithm; Medicine; Biology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00203201,0.001678915,0.001834947,0.005564141,0.001120595,0.002395948,0.001334915,0.001141668,0.002192452],"category_scores_gemma":[0.0044831,0.0004436426,0.001741018,0.00400785,0.0002563577,0.001212677,0.001791103,0.001655563,0.002848988],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005202482,"about_ca_system_score_gemma":0.001517588,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0050275,"about_ca_topic_score_gemma":0.01046515,"domain_scores_codex":[0.9983162,0.0002691795,0.0001185489,0.0004592461,0.0006425678,0.00019433],"domain_scores_gemma":[0.9979413,0.0005804605,0.0001584028,0.0003161177,0.0008505675,0.0001529843],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000367414,0.0006346514,0.02687365,0.0002106543,0.0006864083,0.0001955732,0.0002865458,0.02174006,0.03252177,0.001975589,0.01681259,0.8976952],"study_design_scores_gemma":[0.00003792988,0.0001818532,0.01844003,0.00006460716,0.0003536001,0.0003677761,0.0002532222,0.9364497,0.01664324,0.01542006,0.0117009,0.00008704048],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07277501,0.001487292,0.902081,0.0006852398,0.0001788853,0.0003865964,0.004374329,0.01437777,0.003653924],"genre_scores_gemma":[0.3253761,0.0008046668,0.6537128,0.000333297,0.0002338442,0.0003815573,0.01384225,0.0006136142,0.004701956],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005564141,"threshold_uncertainty_score":0.01074642,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06018250865939074,"score_gpt":0.3751015892239202,"score_spread":0.3149190805645294,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}