{"id":"W2910094941","doi":"10.1016/j.media.2022.102680","title":"The Liver Tumor Segmentation Benchmark (LiTS)","year":2022,"lang":"en","type":"article","venue":"Medical Image Analysis","topic":"Advanced Neural Network Applications","field":"Computer Science","cited_by":1164,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal; Polytechnique Montréal","funders":"National Cancer Institute; National Institutes of Health; Fonds de Recherche du Québec - Santé; Fondation de l'Association des radiologistes du Québec; International Graduate School of Science and Engineering; Universität Zürich; Deutsche Forschungsgemeinschaft","keywords":"Benchmark (surveying); Segmentation; Computer science; Artificial intelligence; Medical physics; Medicine; Pattern recognition (psychology); Cartography","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005894725,0.003970695,0.001684571,0.006624775,0.001294473,0.003236352,0.003734141,0.002990957,0.003361223],"category_scores_gemma":[0.01087799,0.0007127802,0.002128939,0.003970359,0.000934817,0.001491431,0.002852774,0.001356375,0.003598624],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002057533,"about_ca_system_score_gemma":0.002298455,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01113643,"about_ca_topic_score_gemma":0.0164339,"domain_scores_codex":[0.9953822,0.001174532,0.0005674976,0.001019261,0.00145606,0.0004002868],"domain_scores_gemma":[0.9954099,0.001257445,0.0004532657,0.0008631189,0.001443877,0.0005723223],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004095652,0.00146384,0.02879898,0.005908074,0.002914254,0.001259073,0.0004225396,0.09358615,0.02675679,0.003844791,0.4522717,0.3786782],"study_design_scores_gemma":[0.002399145,0.004364596,0.07247692,0.001394963,0.001545092,0.01083423,0.0009637294,0.521034,0.1024999,0.01372891,0.2682689,0.0004896255],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.4232416,0.04194508,0.178795,0.004568449,0.004326615,0.004356465,0.1960163,0.1131371,0.03361341],"genre_scores_gemma":[0.2442802,0.002701101,0.1521175,0.001179323,0.0005012759,0.001052461,0.5855991,0.005246593,0.007322584],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01113643,"threshold_uncertainty_score":0.03117466,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.007724142912540659,"score_gpt":0.2656009642944292,"score_spread":0.2578768213818886,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}