{"id":"W4413888047","doi":"10.1101/2025.08.28.672503","title":"Separating error from bias: A new framework for facial age estimation in humans and AIs","year":2025,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Face recognition and analysis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"","keywords":"Estimation; Computer science; Psychology; Artificial intelligence; Cognitive psychology; Statistics; Mathematics; Economics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01488985,0.0009493007,0.001144103,0.002125445,0.0006968835,0.003493279,0.002661661,0.00162912,0.0029444],"category_scores_gemma":[0.03890699,0.0005313823,0.001188169,0.001028642,0.004388708,0.004064909,0.00305298,0.002256579,0.000504316],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001304908,"about_ca_system_score_gemma":0.00140041,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003694134,"about_ca_topic_score_gemma":0.002875113,"domain_scores_codex":[0.9952397,0.002630575,0.0002250541,0.001057558,0.0006383365,0.0002088075],"domain_scores_gemma":[0.9844033,0.01018301,0.001510364,0.001965885,0.001569486,0.0003680544],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003078328,0.0001746372,0.01848048,0.0003407779,0.0003903349,0.0002460617,0.001961986,0.14428,0.01127974,0.6197085,0.003860233,0.1989694],"study_design_scores_gemma":[0.00002926565,0.0001457728,0.00774903,0.00006372734,0.00007469412,0.0002112955,0.0002050474,0.5672609,0.001239513,0.4194533,0.003466371,0.000101053],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01811126,0.0004413721,0.9779507,0.0009150764,0.00009038666,0.00005379453,0.0001324374,0.0001322274,0.0021727],"genre_scores_gemma":[0.5430782,0.0006646813,0.4519175,0.0005671517,0.0004665038,0.000298552,0.000202159,0.000154682,0.002650585],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01488985,"threshold_uncertainty_score":0.07874602,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03839404834667662,"score_gpt":0.284073950998686,"score_spread":0.2456799026520094,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}