{"id":"W2114329266","doi":"10.1111/j.1754-9485.2012.02442.x","title":"Categorizing segmentation quality using a quantitative quality assurance algorithm","year":2012,"lang":"en","type":"article","venue":"Journal of Medical Imaging and Radiation Oncology","topic":"Advanced Radiotherapy Techniques","field":"Physics and Astronomy","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University; London Health Sciences Centre; Lawson Health Research Institute","funders":"","keywords":"Contouring; Medicine; Quality assurance; Segmentation; Metric (unit); Outlier; Artificial intelligence; Computer science; Medical physics; Algorithm; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002561297,0.00009212201,0.0002970741,0.00008827548,0.00009947871,0.00001896032,0.00008366662,0.0000552711,0.00009424217],"category_scores_gemma":[0.0001427027,0.00007654873,0.000062327,0.00009472725,0.0001090825,0.0005263864,0.00001549437,0.0003101208,4.612518e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001551475,"about_ca_system_score_gemma":0.0002024646,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001815337,"about_ca_topic_score_gemma":8.135927e-7,"domain_scores_codex":[0.9983163,0.0004617107,0.0005709103,0.00008652298,0.0003759222,0.0001886513],"domain_scores_gemma":[0.9983203,0.0005404754,0.0007741668,0.00005470405,0.0001218354,0.0001885267],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00002844248,0.0001972005,0.1576666,0.00001479138,0.00009453908,0.000003410958,0.001992048,0.00003254218,0.005708228,0.00538258,0.0003776941,0.8285019],"study_design_scores_gemma":[0.02606184,0.001415538,0.4465553,0.0007575625,0.0006637509,0.001256946,0.04486568,0.2253312,0.02916892,0.02939659,0.191785,0.002741706],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1026023,0.002394394,0.8926792,0.001604425,0.0005219328,0.00006074462,0.00000453016,0.00001199351,0.0001204484],"genre_scores_gemma":[0.712725,0.0004027374,0.2851253,0.0003918657,0.001324021,0.00000365095,0.000005751159,0.00001290915,0.000008751932],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.8257602,"threshold_uncertainty_score":0.3121567,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03788324064461789,"score_gpt":0.4527806606833723,"score_spread":0.4148974200387544,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}