{"id":"W4416677822","doi":"10.1109/iccams65118.2025.11234017","title":"Mind Duel: Offline AI for Structured Debates","year":2025,"lang":"","type":"article","venue":"","topic":"AI in Service Interactions","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Chatbot; Dialog box; Argumentation theory; Language understanding; Creativity; Tone (literature); Inference","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0001969547,0.0003493102,0.0003620367,0.0003033695,0.0004106863,0.0006704835,0.00164594,0.0002206592,0.00146428],"category_scores_gemma":[0.0001865542,0.0003284806,0.000251775,0.0009626373,0.00009304783,0.0009360014,0.00063108,0.0003225837,0.0001766953],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000128855,"about_ca_system_score_gemma":0.0004627689,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001460085,"about_ca_topic_score_gemma":0.0008203222,"domain_scores_codex":[0.9975346,0.00005902164,0.0007088582,0.0008724754,0.0002365599,0.0005884572],"domain_scores_gemma":[0.9971049,0.0006909668,0.0001625319,0.001141439,0.0007630628,0.0001370559],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002260034,0.0006451752,0.001124249,0.0005088592,0.0008325272,0.0000156458,0.002971998,0.003757997,0.006358064,0.270067,0.2224811,0.4910113],"study_design_scores_gemma":[0.0007859104,0.0001475379,0.0008730498,0.0001362653,0.00009555517,0.00001400047,0.0002157689,0.7058211,0.03862545,0.03195503,0.2209567,0.000373672],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.00318011,0.0003443591,0.9309809,0.04813816,0.00684205,0.0007766872,0.00003956425,0.0001082008,0.009590023],"genre_scores_gemma":[0.7340125,0.00002710071,0.1880871,0.01522543,0.0003781987,0.00008765817,0.00001754847,0.00002686433,0.06213757],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.7428938,"threshold_uncertainty_score":0.9999167,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01372518046008837,"score_gpt":0.326086729247081,"score_spread":0.3123615487869926,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}