{"id":"W3210004388","doi":"10.3390/safety7040072","title":"The State of the Practice in Validation of Model-Based Safety Analysis in Socio-Technical Systems: An Empirical Study","year":2021,"lang":"en","type":"article","venue":"Safety","topic":"Risk and Safety Analysis","field":"Decision Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Terminology; Variety (cybernetics); Sample (material); Empirical research; Risk analysis (engineering); Computer science; Management science; Operations research; Engineering; Medicine; Statistics; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3512497,0.0007743436,0.001867206,0.0170952,0.002290036,0.01370171,0.003560079,0.003046016,0.002886253],"category_scores_gemma":[0.6524377,0.00122097,0.00266672,0.02603585,0.01094377,0.01878821,0.00603092,0.003512198,0.0008041775],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.008542598,"about_ca_system_score_gemma":0.015799,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003378587,"about_ca_topic_score_gemma":0.003173482,"domain_scores_codex":[0.6237318,0.2146688,0.04664008,0.01708132,0.09401798,0.003860109],"domain_scores_gemma":[0.06096343,0.8132465,0.04069745,0.03304464,0.05085443,0.001193461],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001052774,0.001665851,0.2975183,0.05119197,0.002047346,0.001106455,0.1238109,0.006557468,0.003993487,0.06138195,0.007461365,0.4422121],"study_design_scores_gemma":[0.0003363835,0.002687244,0.3992994,0.144151,0.002954794,0.002601796,0.1984518,0.02492169,0.01429442,0.06517144,0.1444075,0.0007226002],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7447034,0.07572858,0.1129176,0.02387603,0.0006700712,0.002718612,0.002423753,0.000253253,0.03670882],"genre_scores_gemma":[0.9483428,0.01544763,0.0316228,0.001655235,0.0001917494,0.001057404,0.0009733368,0.000129858,0.000579207],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3512497,"threshold_uncertainty_score":0.8000247,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06716413126359537,"score_gpt":0.421515823685786,"score_spread":0.3543516924221906,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}