{"id":"W7116969210","doi":"10.1002/alz70862_110016","title":"Expert Evaluation of Deep Learning Approaches to White Matter Hyperintensity Segmentation in Older Adults","year":2025,"lang":"en","type":"article","venue":"Alzheimer s & Dementia","topic":"Dementia and Cognitive Impairment Research","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"","keywords":"Segmentation; Deep learning; Pattern recognition (psychology); Pipeline (software); Artificial neural network; Quality (philosophy)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01227375,0.001052488,0.0006293032,0.0008941261,0.0004192652,0.001077092,0.001034472,0.001419167,0.001991638],"category_scores_gemma":[0.03110494,0.0003045032,0.0008182166,0.0003025981,0.0006029851,0.0007157322,0.001432936,0.0007178656,0.0007226081],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007165062,"about_ca_system_score_gemma":0.0007685676,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002617342,"about_ca_topic_score_gemma":0.004792274,"domain_scores_codex":[0.9948121,0.002520028,0.0005561436,0.001211578,0.0006880679,0.0002120352],"domain_scores_gemma":[0.9855134,0.007584392,0.001374628,0.001204139,0.003448156,0.0008753077],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.02356629,0.002511651,0.1540838,0.001661736,0.002190757,0.0005083837,0.003221691,0.1047289,0.03159843,0.001309177,0.01928743,0.6553317],"study_design_scores_gemma":[0.002131549,0.01156908,0.1757868,0.0006813768,0.001278384,0.001144733,0.001340671,0.7374939,0.05111562,0.005264406,0.0118249,0.0003686424],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9537832,0.001329037,0.03793417,0.0003674935,0.0001607969,0.00071055,0.001133935,0.001272711,0.003308188],"genre_scores_gemma":[0.9558269,0.0003028693,0.04035466,0.0002968904,0.00005584765,0.0003510679,0.001429748,0.0001095428,0.001272554],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01227375,"threshold_uncertainty_score":0.06491053,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06538950314044498,"score_gpt":0.3330597092172868,"score_spread":0.2676702060768418,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}