{"id":"W7008610139","doi":"","title":"Challenges with Estimating Long-Term Overall Survival in Extensive Stage Small-Cell Lung Cancer: A Validation-Based Case Study","year":2024,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Lung Cancer Research Studies","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Durvalumab; Survival analysis; Clinical trial; Covariate; Markov model; Lung cancer; Stage (stratigraphy); Overall survival","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001926494,0.0004655749,0.001163524,0.001148947,0.0002298687,0.000940024,0.0008354964,0.00007951413,0.001582711],"category_scores_gemma":[0.000369034,0.0003629093,0.0001406728,0.0009786044,0.0001398125,0.001057053,0.0006180758,0.0008534327,0.00000365318],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007036622,"about_ca_system_score_gemma":0.001128515,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01020863,"about_ca_topic_score_gemma":0.006053729,"domain_scores_codex":[0.9960358,0.0004606663,0.0008379956,0.0008312337,0.00122477,0.0006095865],"domain_scores_gemma":[0.9968928,0.001069561,0.0004136158,0.000594326,0.0007028028,0.0003269178],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000742176,0.0008753625,0.9454775,0.003530131,0.0009801119,0.03017378,0.002958612,0.002944278,0.002379834,0.000006207038,0.0008201886,0.009111833],"study_design_scores_gemma":[0.00563969,0.0002415625,0.9691612,0.008530024,0.0007860364,0.0003030123,0.003087047,0.00708734,0.004289064,0.00004619542,0.00008974003,0.0007391591],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.910137,0.08502999,0.0002764951,0.000564129,0.0004577547,0.00244843,0.00004964332,0.00007504816,0.0009615041],"genre_scores_gemma":[0.9885799,0.009786365,0.00032742,0.00009536457,0.0002773693,0.0004416515,0.00001103577,0.000107416,0.0003734589],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.07844291,"threshold_uncertainty_score":0.9998823,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3264857909104573,"score_gpt":0.592727764153825,"score_spread":0.2662419732433677,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}