{"id":"W4408613811","doi":"10.2196/54803","title":"Synthetic Data-Driven Approaches for Chinese Medical Abstract Sentence Classification: Computational Study","year":2025,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Traditional Chinese Medicine Studies","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Computer science; Cluster analysis; Artificial intelligence; Sentence; Robustness (evolution); Annotation; Natural language processing; Machine learning; Information retrieval; Data mining","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002374044,0.0001998684,0.0004324751,0.0004869052,0.0004678015,0.00004392326,0.0005870027,0.00008017064,0.0001389841],"category_scores_gemma":[0.002372702,0.0001352265,0.00007593261,0.0008844167,0.0006404656,0.0003183078,0.0003748592,0.0007328716,0.00006333384],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001640098,"about_ca_system_score_gemma":0.0007373291,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0000141275,"about_ca_topic_score_gemma":0.00002551733,"domain_scores_codex":[0.9963557,0.0001732168,0.0005300881,0.0005293537,0.002017527,0.0003941448],"domain_scores_gemma":[0.995852,0.002389334,0.00007840862,0.0006583975,0.0008220708,0.0001998175],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.004655201,0.0297893,0.3572007,0.007656229,0.00477562,0.0002952503,0.037753,0.0006764908,0.0001165523,0.06496021,0.3751866,0.1169349],"study_design_scores_gemma":[0.002574153,0.0005198581,0.8465061,0.0002963496,0.0000339716,0.00003309459,0.006271556,0.1389484,0.000001860905,0.003500194,0.001212145,0.0001023569],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9130165,0.0003687535,0.01048411,0.04185042,0.0003508798,0.006109981,0.0004006072,0.0001802106,0.02723855],"genre_scores_gemma":[0.9968682,0.00001635766,0.0006261509,0.0001445556,0.0002751439,0.0009783885,0.000786168,0.00001631855,0.0002886947],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4893054,"threshold_uncertainty_score":0.5514377,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2631650665508667,"score_gpt":0.490928070791608,"score_spread":0.2277630042407413,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}