{"id":"W4392114235","doi":"10.1109/tvt.2024.3369100","title":"REAL-SAP: Real-Time Evidence Aware Liable Safety Assessment for Perception in Autonomous Driving","year":2024,"lang":"en","type":"article","venue":"IEEE Transactions on Vehicular Technology","topic":"Adversarial Robustness in Machine Learning","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Perception; Reliability engineering; Computer science; Real-time computing; Engineering; Psychology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002323803,0.0009822415,0.0007317184,0.0007694429,0.0002927902,0.001241104,0.001866,0.001055558,0.00198258],"category_scores_gemma":[0.007326016,0.0003457544,0.0004292913,0.0003425061,0.0009415272,0.001962216,0.002330655,0.001317519,0.0003812864],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007562728,"about_ca_system_score_gemma":0.00130496,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002002859,"about_ca_topic_score_gemma":0.002454774,"domain_scores_codex":[0.9991779,0.0002092421,0.00004952216,0.000188431,0.0002889411,0.00008594742],"domain_scores_gemma":[0.9974262,0.001046393,0.0003239634,0.0002958104,0.0007004573,0.0002071105],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009208809,0.0002587604,0.00687188,0.0003164091,0.0001536367,0.0005092168,0.0002996635,0.5622861,0.02181934,0.01427158,0.003418771,0.3888738],"study_design_scores_gemma":[0.00001096503,0.00008135651,0.0005892013,0.00001086024,0.0000124744,0.00005390651,0.00001796074,0.9910135,0.003579979,0.004242046,0.0003752752,0.00001239748],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03292926,0.0002616886,0.9635715,0.0001723879,0.00005260033,0.00007649523,0.00007176953,0.001580298,0.001283952],"genre_scores_gemma":[0.8968409,0.000127962,0.1012804,0.0001307065,0.00004114196,0.0000911461,0.0001433832,0.00008023388,0.001264238],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002323803,"threshold_uncertainty_score":0.01228958,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01283765923528781,"score_gpt":0.2998226571443074,"score_spread":0.2869849979090197,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}