{"id":"W3126608422","doi":"","title":"A Unified Evaluation Framework for Autonomous Driving Vehicles.","year":2020,"lang":"en","type":"article","venue":"IV","topic":"Autonomous Vehicle Technology and Safety","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Huawei Technologies (Canada)","funders":"","keywords":"Reliability (semiconductor); Software deployment; Computer science; Fidelity; Automation; Safety assurance; Test (biology); Reliability engineering; Scenario testing; Engineering; Software engineering; Variety (cybernetics); Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03365613,0.002397389,0.001283227,0.006440809,0.001376699,0.007998056,0.004521644,0.002825354,0.006214139],"category_scores_gemma":[0.0295087,0.001070855,0.002803052,0.00217234,0.002673114,0.006547337,0.006300106,0.003092381,0.003694394],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003122534,"about_ca_system_score_gemma":0.00877214,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008758287,"about_ca_topic_score_gemma":0.007950241,"domain_scores_codex":[0.9746298,0.01054863,0.003321037,0.001940044,0.008593332,0.0009672179],"domain_scores_gemma":[0.9812408,0.005335854,0.00127282,0.003398935,0.007792868,0.000958805],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001467536,0.000418291,0.004264073,0.001390654,0.0002938977,0.0005989401,0.001414054,0.05302142,0.006236327,0.6218707,0.02701464,0.2833303],"study_design_scores_gemma":[0.00009814774,0.0003224692,0.001796267,0.001635638,0.0002154627,0.0008058978,0.0009095103,0.3666493,0.007508286,0.3774217,0.2424676,0.0001697475],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0009962104,0.0004365437,0.9861727,0.0005731985,0.00008345825,0.000813362,0.0004249922,0.003865981,0.006633515],"genre_scores_gemma":[0.04065286,0.0004957177,0.9509851,0.0002956285,0.0001171715,0.001480187,0.001783382,0.0009071869,0.003282823],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.03365613,"threshold_uncertainty_score":0.1779928,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02694590652848825,"score_gpt":0.2580190768332906,"score_spread":0.2310731703048023,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}