{"id":"W4414879996","doi":"10.3389/fmed.2025.1658561","title":"Assessing the ability of ChatGPT 4.0 in generating check-up reports","year":2025,"lang":"en","type":"article","venue":"Frontiers in Medicine","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"Shantou University","keywords":"Quality (philosophy); Task (project management); MEDLINE; Data collection","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02416306,0.000945751,0.0006377347,0.001868976,0.0004010352,0.001394256,0.001223021,0.0006576283,0.003382701],"category_scores_gemma":[0.09539425,0.0005635577,0.001337444,0.001023123,0.0006982946,0.001252941,0.002221193,0.0008947696,0.001495131],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000922102,"about_ca_system_score_gemma":0.001915914,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001911728,"about_ca_topic_score_gemma":0.002615863,"domain_scores_codex":[0.9874473,0.008153668,0.001629349,0.0008456993,0.001538698,0.0003851409],"domain_scores_gemma":[0.8671179,0.100373,0.008898347,0.00575659,0.01499422,0.002859908],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0047791,0.002099296,0.4825777,0.003703617,0.0004958161,0.001120395,0.02089424,0.007413021,0.01178163,0.0008373771,0.01545873,0.448839],"study_design_scores_gemma":[0.001518371,0.0112805,0.7910655,0.001821129,0.001385303,0.004656092,0.01106543,0.1191322,0.02715487,0.003115097,0.02700421,0.0008013909],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9390885,0.0003377816,0.04289261,0.0006024968,0.0001308783,0.0048308,0.001782475,0.003728098,0.006606395],"genre_scores_gemma":[0.8564354,0.0004252058,0.1341471,0.0003952193,0.00007832304,0.003664081,0.002322337,0.0003308048,0.002201547],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02416306,"threshold_uncertainty_score":0.1277881,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09823028129739164,"score_gpt":0.4564255017259141,"score_spread":0.3581952204285224,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}