{"id":"W4409633347","doi":"10.1088/3050-2454/adcef2","title":"Reliability engineering, risk management, and trustworthiness assurance for AI systems","year":2025,"lang":"en","type":"article","venue":"Journal of Reliability Science and Engineering","topic":"Risk and Safety Analysis","field":"Decision Sciences","cited_by":10,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Trustworthiness; Reliability engineering; Reliability (semiconductor); Risk management; Computer science; Quality assurance; Risk analysis (engineering); Engineering; Computer security; Operations management; Medicine; Business","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007467451,0.000577136,0.000625634,0.00181209,0.001049412,0.003016648,0.0008138418,0.001177572,0.00136979],"category_scores_gemma":[0.04054286,0.0004234619,0.0005993567,0.0007814874,0.002405275,0.003336384,0.001342859,0.001839931,0.000177507],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001902388,"about_ca_system_score_gemma":0.002824956,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003620552,"about_ca_topic_score_gemma":0.002256172,"domain_scores_codex":[0.9944371,0.002557673,0.0003779013,0.0003999967,0.001960663,0.0002667146],"domain_scores_gemma":[0.9696615,0.01973397,0.004155938,0.002446202,0.003477891,0.000524564],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000385742,0.0002329126,0.0140187,0.0005234788,0.0002860262,0.0002594132,0.00158363,0.2703564,0.007126907,0.5341708,0.002481572,0.1685743],"study_design_scores_gemma":[0.00003439316,0.0002016578,0.002484657,0.0001045615,0.00009819832,0.0001321257,0.000310855,0.5112266,0.002079458,0.4802889,0.00299258,0.00004609632],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1469742,0.003860595,0.8265262,0.006156556,0.0001605568,0.000106476,0.00006714408,0.000261467,0.01588685],"genre_scores_gemma":[0.9414349,0.0006697291,0.05650679,0.0001083211,0.0001656232,0.00004652753,0.00003080889,0.00002482625,0.001012387],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.007467451,"threshold_uncertainty_score":0.03949213,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01179522341916349,"score_gpt":0.2965353064739225,"score_spread":0.284740083054759,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}