{"id":"W7103104071","doi":"","title":"The Narrative Continuity Test: A Conceptual Framework for Evaluating Identity Persistence in AI Systems","year":2025,"lang":"","type":"article","venue":"ArXiv.org","topic":"Persona Design and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Narrative; Context (archaeology); Identity (music); Coherence (philosophical gambling strategy); Conceptual framework; Situated; Generative grammar","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02974175,0.0008310632,0.0006538713,0.006054947,0.001635347,0.004982665,0.002497134,0.001933545,0.004191178],"category_scores_gemma":[0.1521379,0.0003064873,0.001102586,0.003313819,0.006163703,0.01363301,0.004899985,0.002157286,0.0004977887],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003017079,"about_ca_system_score_gemma":0.002683548,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005574165,"about_ca_topic_score_gemma":0.002971814,"domain_scores_codex":[0.9756753,0.01210891,0.002840024,0.001775393,0.006895019,0.0007052308],"domain_scores_gemma":[0.8616182,0.1021756,0.0128077,0.0110949,0.009592365,0.002711261],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.002257122,0.00132408,0.2556976,0.001200204,0.0006398376,0.0003964902,0.01435164,0.0714445,0.007620728,0.344069,0.005979721,0.295019],"study_design_scores_gemma":[0.0003091682,0.00560663,0.1048623,0.0007249843,0.0003280437,0.0006355926,0.01556345,0.3572027,0.01939471,0.4746975,0.02022369,0.0004513416],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.4164893,0.0007647678,0.5220551,0.002684159,0.0001603777,0.001646122,0.002191923,0.001508993,0.05249931],"genre_scores_gemma":[0.9306384,0.00007096863,0.06692518,0.0001713287,0.00002500967,0.000713004,0.0007520968,0.00008645843,0.0006175913],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02974175,"threshold_uncertainty_score":0.1572913,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1059554235835739,"score_gpt":0.37466355025563,"score_spread":0.2687081266720561,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}