{"id":"W7117277568","doi":"","title":"Can LLMs Predict Their Own Failures? Self-Awareness via Internal Circuits","year":2025,"lang":"","type":"article","venue":"ArXiv.org","topic":"Topic Modeling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Correctness; Inference; Process (computing); Decoding methods; Sequence (biology); Internal model","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0007540842,0.0007313365,0.0007248633,0.00040147,0.0006006575,0.0005226489,0.003884754,0.0003908164,0.0001395889],"category_scores_gemma":[0.0001238911,0.0006961466,0.0003391158,0.001134094,0.0001724687,0.000767347,0.001920508,0.0009672896,0.0001819613],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000427051,"about_ca_system_score_gemma":0.001214483,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001184589,"about_ca_topic_score_gemma":0.0005117239,"domain_scores_codex":[0.994785,0.0003355563,0.00112885,0.001834448,0.0006379089,0.001278258],"domain_scores_gemma":[0.9961703,0.0002389917,0.0003805234,0.002439815,0.0003742074,0.0003961434],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001657963,0.0003672008,0.8508435,0.0003013911,0.0005098512,0.0001690083,0.006070571,0.0008771064,0.002039484,0.004761517,0.0008134753,0.1332302],"study_design_scores_gemma":[0.002166223,0.0002829043,0.2269977,0.001461617,0.0001967924,0.0001257263,0.0003172771,0.7277798,0.01440569,0.004071256,0.02069937,0.001495645],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5459455,0.0006952956,0.4418763,0.00407155,0.005272715,0.0003979343,0.00001467044,0.0003776684,0.001348474],"genre_scores_gemma":[0.9946927,0.0001203745,0.00103105,0.001493217,0.00070403,0.00005631202,0.000006238774,0.00004413025,0.001851955],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7269027,"threshold_uncertainty_score":0.999549,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02677271643426992,"score_gpt":0.2505918237108248,"score_spread":0.2238191072765549,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}