{"id":"W4399318945","doi":"10.20944/preprints202404.0359.v2","title":"A Turing Test for Self-Awareness","year":2024,"lang":"en","type":"preprint","venue":"Preprints.org","topic":"Free Will and Agency","field":"Neuroscience","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Test (biology); Turing; Computer science; Turing test; Psychology; Artificial intelligence; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0004250917,0.0004908125,0.000449515,0.0001948177,0.0002064148,0.00009970736,0.001273343,0.0003478166,0.0003255403],"category_scores_gemma":[0.001523085,0.0004657604,0.0003943244,0.0002290245,0.00008480774,0.00008264378,0.004756583,0.001054805,0.003440236],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001522527,"about_ca_system_score_gemma":0.0003174291,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00007184343,"about_ca_topic_score_gemma":0.0000115859,"domain_scores_codex":[0.9964211,0.00007608585,0.000524399,0.002003236,0.000384424,0.0005907292],"domain_scores_gemma":[0.9976647,0.000484993,0.0001959263,0.001410382,0.00006962964,0.0001743608],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.00006259111,0.0009835107,0.1606722,0.007689565,0.0001145824,0.0002836957,0.003021144,0.0009629998,0.8167537,0.005620376,0.0009034915,0.002932135],"study_design_scores_gemma":[0.0002997025,0.00002867152,0.01835165,0.0005862759,0.0001465604,0.00003206139,0.0000208697,0.002728672,0.9202055,0.03726555,0.01952431,0.0008101373],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9743923,0.0001876969,0.0001170728,0.0007931652,0.003902232,0.001384851,0.0002223702,0.001347896,0.01765242],"genre_scores_gemma":[0.9917064,0.0001524296,0.0002308181,0.0002462488,0.0006967378,0.000883417,0.00001289648,0.0001080968,0.00596301],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1423206,"threshold_uncertainty_score":0.9997794,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1804553038495121,"score_gpt":0.3641869574771319,"score_spread":0.1837316536276198,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}