{"id":"W4412163857","doi":"10.1158/1557-3265.aimachine-b012","title":"Abstract B012: Prompting Large Language Models to Predict Adverse Events during Cancer Treatment","year":2025,"lang":"en","type":"article","venue":"Clinical Cancer Research","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University Health Network; Princess Margaret Cancer Centre","funders":"","keywords":"Adverse effect; Cancer; Medicine; Intensive care medicine; Oncology; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005265129,0.001309897,0.0006336144,0.001006364,0.0002922548,0.001066269,0.001103912,0.001022434,0.004360198],"category_scores_gemma":[0.0171686,0.0003452532,0.001215087,0.0004700058,0.0002370673,0.001106214,0.001000768,0.001543129,0.001437114],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001102408,"about_ca_system_score_gemma":0.001546051,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009476908,"about_ca_topic_score_gemma":0.008180165,"domain_scores_codex":[0.9983703,0.0009611686,0.0001261476,0.0003366461,0.0001212313,0.000084474],"domain_scores_gemma":[0.9857555,0.01175012,0.0006318145,0.0005609216,0.0009625572,0.0003390187],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"not_applicable","study_design_scores_codex":[0.004176822,0.001521343,0.1170547,0.0006228626,0.0007051069,0.0004520038,0.0003264919,0.5025027,0.003830685,0.001366144,0.02808777,0.3393534],"study_design_scores_gemma":[0.0001228197,0.0004263897,0.004885744,0.00004608363,0.0000812482,0.00004605366,0.00005288989,0.9897432,0.001561463,0.00178377,0.001220968,0.00002932328],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"other","genre_scores_codex":[0.7731538,0.001627239,0.174982,0.005450069,0.000610004,0.0006018365,0.01507646,0.02361115,0.004887444],"genre_scores_gemma":[0.9358513,0.0002071644,0.05199188,0.0006042249,0.0001682995,0.0002325111,0.009001084,0.0001703618,0.001773214],"genre_candidate":"other","genre_consensus":null,"teacher_disagreement_score":0.009476908,"threshold_uncertainty_score":0.02784503,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5986622321742983,"score_gpt":0.6997175649584702,"score_spread":0.1010553327841719,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}