{"id":"W4403420028","doi":"10.1016/j.jtho.2024.09.106","title":"MA02.11 Validation of the Sybil Deep Learning Lung Cancer Risk Prediction Model in Three Independent Screening Studies","year":2024,"lang":"en","type":"article","venue":"Journal of Thoracic Oncology","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"BC Cancer Foundation; University of Calgary; Lunenfeld-Tanenbaum Research Institute","funders":"","keywords":"Medicine; Lung cancer; Artificial intelligence; Oncology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.004568905,0.0001288146,0.0004559214,0.0003178086,0.0004390164,0.000008092542,0.000249408,0.0003299917,0.00008023336],"category_scores_gemma":[0.001378811,0.00008770192,0.0001314589,0.000428748,0.00009636658,0.0002765704,0.0001687761,0.002509096,0.000004660107],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001408741,"about_ca_system_score_gemma":0.001055723,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001048556,"about_ca_topic_score_gemma":0.01290603,"domain_scores_codex":[0.9957319,0.001765196,0.001548741,0.0001845834,0.0004375224,0.0003320579],"domain_scores_gemma":[0.9963389,0.001438044,0.001309534,0.0001540983,0.0006879366,0.00007146353],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002220131,0.00003268321,0.6226184,0.0005389869,0.0001034648,0.00001588893,0.01633924,0.2846264,0.0001919762,0.0001446196,0.0002377059,0.07492863],"study_design_scores_gemma":[0.0001598937,0.0003292066,0.0486206,0.004028056,0.0003469797,0.00002440812,0.02828348,0.9091772,0.0007999869,0.007308897,0.0008010548,0.0001201953],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9645765,0.00770256,0.01968935,0.003690892,0.003648873,0.0005065519,0.00001261612,0.00002544017,0.000147253],"genre_scores_gemma":[0.9959624,0.001967467,0.001099837,0.00009265408,0.0006167492,0.00005196406,9.140969e-7,0.00002322676,0.0001847581],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6245508,"threshold_uncertainty_score":0.9997922,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.184194206532553,"score_gpt":0.5764971891287354,"score_spread":0.3923029825961824,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}