{"id":"W4415569782","doi":"10.1016/j.exer.2025.110700","title":"Postoperative data leakage in AI-based IOL power prediction formulas: a hidden source of bias","year":2025,"lang":"en","type":"article","venue":"Experimental Eye Research","topic":"Retinal Imaging and Analysis","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; Université de Montréal; McGill University","funders":"","keywords":"Biometrics; Mean squared prediction error; Refraction; Power (physics); Predictive modelling; Predictive power; Range (aeronautics); Biometric data; Set (abstract data type)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.005183585,0.0007229883,0.0006772559,0.000470843,0.0002293908,0.001258311,0.001000617,0.0005551687,0.0006396411],"category_scores_gemma":[0.0197904,0.0003477943,0.0005699578,0.0003621835,0.0005070495,0.001562475,0.0007759047,0.001022506,0.0003083666],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006548042,"about_ca_system_score_gemma":0.0008689695,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002599128,"about_ca_topic_score_gemma":0.00229372,"domain_scores_codex":[0.9984779,0.0005268032,0.000152072,0.0002862181,0.0004438705,0.0001131322],"domain_scores_gemma":[0.9915103,0.005565598,0.0007295127,0.00091872,0.001190226,0.00008568889],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001693555,0.0003334822,0.07921438,0.0003780337,0.0004392463,0.0002596221,0.0004966535,0.4307442,0.02095213,0.003610799,0.00183375,0.4600443],"study_design_scores_gemma":[0.00002562923,0.0003252189,0.008521007,0.00005256972,0.00005702663,0.0001469178,0.00004302006,0.9742101,0.01350803,0.002366135,0.0007151691,0.0000292115],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.641418,0.001887812,0.3510477,0.0009065109,0.0001622927,0.0001383681,0.0002866975,0.001747812,0.002404791],"genre_scores_gemma":[0.9791816,0.0001686157,0.01967234,0.0001463903,0.00002550871,0.00004258356,0.0001435776,0.0000726095,0.0005467358],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9948164,"threshold_uncertainty_score":0.02741373,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1176369063483444,"score_gpt":0.4819524744199014,"score_spread":0.3643155680715571,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}