{"id":"W4404893442","doi":"10.2196/59961","title":"Application of Clinical Department–Specific AI-Assisted Coding Using Taiwan Diagnosis-Related Groups: Retrospective Validation Study","year":2024,"lang":"en","type":"article","venue":"JMIR Human Factors","topic":"Medical Coding and Health Information","field":"Health Professions","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Preprint; Computer science; Coding (social sciences); Artificial intelligence; Machine learning; World Wide Web; Statistics; Mathematics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002548399,0.000211709,0.0005359572,0.0003408154,0.0009563342,0.00003885667,0.0001789755,0.0003793773,0.0005092449],"category_scores_gemma":[0.0002619623,0.0001795716,0.0001393599,0.0006349391,0.00008681655,0.0003698967,0.00008063314,0.001214071,0.0001398153],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005994484,"about_ca_system_score_gemma":0.0002016142,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00012471,"about_ca_topic_score_gemma":0.00004684831,"domain_scores_codex":[0.995503,0.0007704442,0.002247534,0.0004303558,0.0006440511,0.0004045797],"domain_scores_gemma":[0.9978194,0.000594627,0.0007205397,0.0003728017,0.0002662451,0.0002263812],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002826056,0.0003587323,0.9763059,0.0004579378,0.00007303891,0.000002193382,0.01179856,0.000007951291,0.0001366598,0.005922536,0.002339485,0.002568721],"study_design_scores_gemma":[0.0009703307,0.0004079201,0.9861823,0.0005095007,0.00006915531,4.189588e-7,0.004602234,0.00234778,0.00005221371,0.0006440815,0.004021243,0.0001927854],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9918588,0.00005373107,0.002238501,0.0001805781,0.001362934,0.002953729,0.0000421611,0.0003454398,0.0009640694],"genre_scores_gemma":[0.9985587,0.00001972265,0.00005085799,0.00008599254,0.0003437521,0.0004924398,0.0003195977,0.00003429902,0.00009463866],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.009876416,"threshold_uncertainty_score":0.7355446,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3439701011570389,"score_gpt":0.5460547891520818,"score_spread":0.202084687995043,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}