{"id":"W4403541273","doi":"10.2196/47814","title":"Fine-Tuned Bidirectional Encoder Representations From Transformers Versus ChatGPT for Text-Based Outpatient Department Recommendation: Comparative Study","year":2024,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Institute for Information and Communications Technology Promotion; Ministry of Science and ICT, South Korea; Iran Telecommunication Research Center","keywords":"Recall; Specialty; Encoder; Computer science; Medicine; Precision and recall; Outpatient clinic; Health care; Artificial intelligence; Medical physics; Family medicine; Psychology; Internal medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001959668,0.001204808,0.0008799839,0.001102529,0.0002829549,0.0009227071,0.001101278,0.001259967,0.002146038],"category_scores_gemma":[0.008930879,0.000327192,0.0007162553,0.0008078992,0.0002954795,0.001892306,0.0006039091,0.00123113,0.001111026],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001486598,"about_ca_system_score_gemma":0.001504783,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.03238055,"about_ca_topic_score_gemma":0.02817728,"domain_scores_codex":[0.9991172,0.0003853477,0.00006968086,0.0002056593,0.0001402416,0.00008194353],"domain_scores_gemma":[0.9955177,0.003261163,0.0001772729,0.0003233808,0.0005688407,0.0001516759],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002719132,0.001894623,0.0242084,0.0008637483,0.0005847072,0.0003220033,0.0003183441,0.2809342,0.006698458,0.001331691,0.01055148,0.6695732],"study_design_scores_gemma":[0.00009644723,0.000426848,0.002641403,0.00003639636,0.0001451359,0.00008492498,0.00008371477,0.9926191,0.002483531,0.0004817813,0.0008765188,0.00002423575],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8700056,0.009269227,0.1020491,0.001149793,0.0003989009,0.0004675447,0.003062906,0.006464225,0.007132772],"genre_scores_gemma":[0.9550295,0.001221477,0.03691485,0.000216078,0.00008412878,0.0001211288,0.004068358,0.00008117312,0.002263144],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03238055,"threshold_uncertainty_score":0.06438416,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4391246705023308,"score_gpt":0.5856615413913773,"score_spread":0.1465368708890464,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}