{"id":"W4407933848","doi":"10.3389/fonc.2025.1492758","title":"Data augmented lung cancer prediction framework using the nested case control NLST cohort","year":2025,"lang":"en","type":"article","venue":"Frontiers in Oncology","topic":"Lung Cancer Diagnosis and Treatment","field":"Medicine","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"Institut universitaire de cardiologie et de pneumologie de Québec; Université Laval","funders":"","keywords":"Nested case-control study; Medicine; Lung cancer; Cancer; Computer science; Cohort; Artificial intelligence; Oncology; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003563807,0.0001434143,0.0004345669,0.0001343754,0.0001342888,0.000014233,0.0001623178,0.0002157298,0.00007213366],"category_scores_gemma":[0.000180019,0.0001017067,0.00004448005,0.0003608633,0.0001208088,0.00006745146,0.00008658578,0.0003283164,7.114838e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00260843,"about_ca_system_score_gemma":0.0006420983,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001268559,"about_ca_topic_score_gemma":0.000813832,"domain_scores_codex":[0.9987343,0.0001688854,0.0003118751,0.0003946635,0.0001233735,0.0002669113],"domain_scores_gemma":[0.9988205,0.0002851082,0.00009771336,0.0006716552,0.00006378917,0.0000612481],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003495961,0.0002636699,0.8916593,0.00005378323,0.0009907661,0.0009246243,0.0001375705,0.0004584493,0.000008522504,0.00007267075,0.09569965,0.009381452],"study_design_scores_gemma":[0.01423086,0.0004688977,0.4284735,0.001315483,0.006327512,0.0005533294,0.001512486,0.4252596,0.00006134869,0.0003066119,0.1212271,0.0002633588],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6472492,0.04263331,0.2299561,0.04065283,0.02604709,0.008268431,0.001725798,0.0002302668,0.003237006],"genre_scores_gemma":[0.9885924,0.001265371,0.005367272,0.003544164,0.0003561827,0.0004631666,0.0001169676,0.00001908127,0.0002754196],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4631858,"threshold_uncertainty_score":0.6820955,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02368786007109672,"score_gpt":0.3851702921890091,"score_spread":0.3614824321179124,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}