{"id":"W4399801463","doi":"10.1109/ichms59971.2024.10555797","title":"AI Agents Learning Human Decision Policies for Collaborative Situation Assessment in NORAD C2 Operations","year":2024,"lang":"en","type":"article","venue":"","topic":"Human-Automation Interaction and Safety","field":"Psychology","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Thales (Canada)","funders":"","keywords":"Computer science; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002332641,0.0005760465,0.000400217,0.0004484481,0.0006899008,0.00119255,0.0008203521,0.0007546702,0.0009471646],"category_scores_gemma":[0.007188443,0.0002759158,0.0002605451,0.0002063241,0.0005742265,0.001074613,0.00138432,0.001226093,0.0001647711],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001015723,"about_ca_system_score_gemma":0.00154375,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00815171,"about_ca_topic_score_gemma":0.006754964,"domain_scores_codex":[0.999204,0.0004049679,0.00003742571,0.0001575195,0.0001111027,0.00008504729],"domain_scores_gemma":[0.996759,0.002059456,0.0003405696,0.0002384048,0.000379247,0.0002232956],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003281037,0.0005913463,0.009007568,0.00003730558,0.00006580511,0.0000945117,0.0008977956,0.8956898,0.003637796,0.003537312,0.0005392376,0.08557342],"study_design_scores_gemma":[0.00000716027,0.00006984201,0.0006576407,0.000003136365,0.000006251591,0.000007554232,0.0001080246,0.9965909,0.001216431,0.001093881,0.0002327283,0.000006462783],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6227115,0.00008509758,0.3724189,0.0003797735,0.00002865782,0.0001707487,0.00002772572,0.0004146695,0.003762889],"genre_scores_gemma":[0.9689676,0.00002138284,0.03025127,0.00003462965,0.00000548295,0.00004352136,0.00002178368,0.000009013488,0.0006453723],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.00815171,"threshold_uncertainty_score":0.01620853,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06232438609141281,"score_gpt":0.5005548206881335,"score_spread":0.4382304345967207,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}