{"id":"W4413467640","doi":"10.2196/76252","title":"Automated Literature Screening for Hepatocellular Carcinoma Treatment Through Integration of 3 Large Language Models: Methodological Study","year":2025,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Topic Modeling","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Preprint; Hepatocellular carcinoma; Computer science; Medicine; World Wide Web; Internal medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009110022,0.0001718579,0.0003755418,0.0001173928,0.00008601112,0.00007959346,0.0005824497,0.0002043457,0.000005980635],"category_scores_gemma":[0.0002174308,0.0001171603,0.0001123965,0.000412322,0.00002822593,0.0005655879,0.0002226153,0.0001892536,0.000001088566],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005848338,"about_ca_system_score_gemma":0.0001207017,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0000261055,"about_ca_topic_score_gemma":0.000005921425,"domain_scores_codex":[0.9982486,0.0001493709,0.0007305135,0.0001674873,0.0004461283,0.0002578591],"domain_scores_gemma":[0.9987981,0.0003286074,0.0001653474,0.0004919565,0.0001363602,0.00007965921],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001323422,0.002243467,0.002867209,0.0009385339,0.000367389,0.00008988797,0.4959445,0.001886475,0.0002246285,0.2762652,0.001590303,0.2174501],"study_design_scores_gemma":[0.001295034,0.0002850796,0.0001271659,0.0001560624,0.00001871549,0.000004277587,0.005197137,0.990149,0.0006786248,0.001768104,0.0002231215,0.00009772793],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2491949,0.000146689,0.7490107,0.0001868361,0.0001060327,0.0007668919,0.000009440098,0.000243584,0.000334855],"genre_scores_gemma":[0.6463825,0.000006695465,0.353048,0.0003232732,0.00002363076,0.0001307365,0.00002775659,0.00000339769,0.00005408529],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9882625,"threshold_uncertainty_score":0.4777659,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1081143011567895,"score_gpt":0.3935581168012115,"score_spread":0.285443815644422,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}