{"id":"W4402552507","doi":"10.2196/62924","title":"Use of SNOMED CT in Large Language Models: Scoping Review","year":2024,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"SNOMED CT; Computer science; Medicine; Natural language processing; Data science; Terminology; Linguistics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007047877,0.0000821851,0.0002983028,0.0001528996,0.00001608578,0.0000147103,0.00007144015,0.0000752104,0.0005117325],"category_scores_gemma":[0.0005882519,0.00006332193,0.0000621318,0.0004113909,0.00004778476,0.0003534691,0.00003304533,0.0003389126,0.00008921744],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006246947,"about_ca_system_score_gemma":0.0006485507,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001108441,"about_ca_topic_score_gemma":0.00007494322,"domain_scores_codex":[0.9982304,0.00002672033,0.0009961817,0.00006692953,0.000463458,0.0002163327],"domain_scores_gemma":[0.9992395,0.0002440279,0.00007292791,0.0001993377,0.00006177917,0.0001824203],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"systematic_review","study_design_scores_codex":[0.00004447262,0.000466627,0.001833092,0.2358249,0.0000541032,0.0002435678,0.06256937,0.00002494808,0.00001833505,0.004952991,0.01801157,0.675956],"study_design_scores_gemma":[0.0001712087,0.0002559899,0.0001812535,0.6244259,0.00008690113,0.0002201807,0.01248035,0.3525321,0.001295856,0.0007414353,0.007289132,0.0003196282],"study_design_candidate":"systematic_review","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.923897,0.05349374,0.004615336,0.008159561,0.0009778559,0.003363218,0.00002161312,0.000228865,0.005242861],"genre_scores_gemma":[0.9657519,0.02385989,0.001410203,0.008283494,0.0002086471,0.0001463349,0.000107035,0.00001950315,0.000212971],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6756364,"threshold_uncertainty_score":0.5603112,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2162662737954711,"score_gpt":0.4886790875448922,"score_spread":0.2724128137494212,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}