{"id":"W4394972023","doi":"10.48550/arxiv.2404.12226","title":"A cooperative strategy for diagnosing the root causes of quality requirement violations in multiagent systems","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Multi-Agent Systems and Negotiation","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico; Coordenação de Aperfeiçoamento de Pessoal de Nível Superior; Government of Canada","keywords":"Root (linguistics); Multi-agent system; Quality (philosophy); Computer science; Risk analysis (engineering); Business; Artificial intelligence","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008404953,0.0002227215,0.0003517175,0.0002037102,0.0001365452,0.0001654239,0.0007095542,0.00015119,0.000003613752],"category_scores_gemma":[0.00007234228,0.0001882923,0.000160513,0.0004352813,0.00005189077,0.000197633,0.0006882722,0.0002681865,0.000007838278],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000331825,"about_ca_system_score_gemma":0.0002500141,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002988738,"about_ca_topic_score_gemma":0.002206192,"domain_scores_codex":[0.9980462,0.0004020795,0.0004967097,0.0007162501,0.0001202453,0.0002185424],"domain_scores_gemma":[0.9981158,0.0004551559,0.0003996978,0.0007243496,0.0002492274,0.00005576344],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001153411,0.000104548,0.003303558,0.0004407518,0.000094533,0.00001519888,0.001470693,0.704982,0.0001932358,0.289189,0.00009750494,0.00009734374],"study_design_scores_gemma":[0.0004461878,0.00005659767,0.00924178,0.0006442821,0.00005723178,7.190932e-7,0.0006752406,0.9844474,0.0003791391,0.003675154,0.0001127019,0.0002635269],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5046993,0.0004289599,0.4918271,0.0001239813,0.000963763,0.00163886,0.00007742007,0.000065644,0.0001749481],"genre_scores_gemma":[0.9993848,0.00005876738,0.0001389159,0.00001197386,0.0000602625,0.00002526493,0.00001812366,0.00001132117,0.0002906357],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4946854,"threshold_uncertainty_score":0.7678336,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2443863893154581,"score_gpt":0.2865613909352424,"score_spread":0.0421750016197843,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}