{"id":"W4412054466","doi":"10.1016/j.ajoint.2025.100154","title":"Fundus photograph interpretation of common retinal disorders by artificial intelligence chatbots","year":2025,"lang":"en","type":"article","venue":"AJO International","topic":"Retinal Imaging and Analysis","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"St. Michael's Hospital; University of Toronto","funders":"","keywords":"Interpretation (philosophy); Fundus (uterus); Retinal; Optometry; Artificial intelligence; Computer science; Ophthalmology; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007305987,0.0006113957,0.0004847421,0.001618679,0.0004015915,0.0008991375,0.0006935251,0.0007350995,0.002796888],"category_scores_gemma":[0.02525985,0.000398962,0.0005262488,0.0004801249,0.0004587692,0.000759415,0.001011269,0.0003843727,0.0007451763],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008554466,"about_ca_system_score_gemma":0.0004490324,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002179078,"about_ca_topic_score_gemma":0.003089908,"domain_scores_codex":[0.9953093,0.002633186,0.0003770603,0.0007970636,0.000669974,0.0002133379],"domain_scores_gemma":[0.9706385,0.01667569,0.006110884,0.001869903,0.003560258,0.001144864],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.007171652,0.001386802,0.8933471,0.0005858106,0.0002705862,0.0007394137,0.002156994,0.001346877,0.007089357,0.00008778913,0.001641968,0.08417568],"study_design_scores_gemma":[0.0003069235,0.00732874,0.9681064,0.0002260886,0.0002708358,0.002755358,0.00122992,0.01041351,0.006065998,0.0001797941,0.003034389,0.0000819971],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9947572,0.0004777389,0.001658083,0.00009595586,0.00003325364,0.0004188419,0.0002684174,0.0001637629,0.002126824],"genre_scores_gemma":[0.9941935,0.0001977567,0.004202469,0.0001819511,0.00003866487,0.0002102539,0.0003001302,0.0000150481,0.0006602805],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.007305987,"threshold_uncertainty_score":0.03863817,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.009699536057673371,"score_gpt":0.3191033846953664,"score_spread":0.309403848637693,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}