{"id":"W7131243771","doi":"10.1109/jproc.2026.3659717","title":"Open-World Verification: A Grand Challenge for Autonomous Systems","year":2025,"lang":"en","type":"article","venue":"Proceedings of the IEEE","topic":"Formal Methods in Verification","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Pleiades Robotics (Canada)","funders":"European Commission; Royal Academy of Engineering; Jet Propulsion Laboratory; UK Research and Innovation; California Institute of Technology; National Aeronautics and Space Administration","keywords":"Viewpoints; Automation; Robotics; Process (computing); Key (lock); Autonomy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009316013,0.00009684689,0.0001736465,0.0001022317,0.0001754461,0.0002711975,0.003150212,0.00004505786,6.265253e-7],"category_scores_gemma":[0.0001412673,0.00007435231,0.000060224,0.0005860598,0.0000545299,0.0006135718,0.0003241302,0.00008116126,0.000002519178],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006395006,"about_ca_system_score_gemma":0.0000689591,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001555654,"about_ca_topic_score_gemma":0.000001516558,"domain_scores_codex":[0.9991024,0.000009851307,0.0002929978,0.0002912679,0.0001466028,0.000156916],"domain_scores_gemma":[0.9990021,0.00005713365,0.0002621282,0.0003309971,0.0003222302,0.00002542136],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00001956516,0.00004646413,0.00005711639,0.0002675336,0.00001774197,1.411596e-8,0.000320735,0.00002377387,0.003342732,0.9844998,0.005657828,0.005746713],"study_design_scores_gemma":[0.002051183,0.0002563919,0.002281158,0.0008473013,0.00008492009,0.0000107365,0.0002586055,0.2572528,0.2903013,0.1156696,0.3304098,0.0005761886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01261065,0.001205979,0.7449352,0.01216325,0.008958754,0.006170626,0.00001572268,0.0004077115,0.2135321],"genre_scores_gemma":[0.6824222,0.00002496705,0.3079726,0.0001851759,0.0001084339,0.0007010124,3.665197e-7,0.00001310278,0.008572073],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.8688302,"threshold_uncertainty_score":0.585393,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04566996870659187,"score_gpt":0.3176068745893962,"score_spread":0.2719369058828044,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}