{"id":"W4312974298","doi":"10.2196/38150","title":"An End-to-End Natural Language Processing Application for Prediction of Medical Case Coding Complexity: Algorithm Development and Validation","year":2022,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Computer science; Medical classification; Coding (social sciences); Metadata; Documentation; Machine learning; Artificial intelligence; Data mining; Medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005045103,0.001751071,0.0008941636,0.001903874,0.0007938668,0.001212834,0.001928295,0.002317778,0.005103623],"category_scores_gemma":[0.01437498,0.0005013795,0.0009449422,0.0009256649,0.0005402618,0.001392895,0.001405087,0.001724908,0.001971373],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001563534,"about_ca_system_score_gemma":0.002168672,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00996586,"about_ca_topic_score_gemma":0.00918689,"domain_scores_codex":[0.9975365,0.000827548,0.0003172692,0.0007797453,0.0003971357,0.00014166],"domain_scores_gemma":[0.9909776,0.006337035,0.0002870153,0.0004561168,0.001744391,0.000197823],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001856338,0.002938426,0.01973966,0.0006369911,0.0004243061,0.001211326,0.0007027679,0.1818582,0.02127181,0.002478422,0.02015066,0.7467312],"study_design_scores_gemma":[0.000105158,0.0001905191,0.001715485,0.00002013744,0.00002570333,0.00009925722,0.00006885669,0.9891772,0.00682276,0.0007383469,0.001017909,0.0000186117],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2258771,0.0004313109,0.708008,0.0007757121,0.0002430983,0.002154747,0.003073454,0.05724758,0.002189022],"genre_scores_gemma":[0.2576029,0.000124159,0.7323313,0.0003370516,0.0000421226,0.002093509,0.005134733,0.0004063537,0.001927785],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.00996586,"threshold_uncertainty_score":0.02668136,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03208591677609966,"score_gpt":0.357616337529728,"score_spread":0.3255304207536284,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}