{"id":"W4416030402","doi":"10.48550/arxiv.2507.14063","title":"Collaborative Rational Speech Act: Pragmatic Reasoning for Multi-Turn Dialog","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Mila - Quebec Artificial Intelligence Institute","funders":"","keywords":"Dialog box; Conversation; Speech act; Extension (predicate logic); Function (biology); Dialog system; Face (sociological concept)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0008051755,0.0004282787,0.0006159438,0.0002326518,0.000271229,0.0003612301,0.001453375,0.0004094751,0.00001323807],"category_scores_gemma":[0.00146773,0.000411487,0.000223402,0.000520814,0.00006377903,0.0003358234,0.001047315,0.0004780983,0.0001174748],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000210274,"about_ca_system_score_gemma":0.001683832,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001252682,"about_ca_topic_score_gemma":0.0002144031,"domain_scores_codex":[0.9972379,0.0002313951,0.0006271024,0.001025327,0.0003898765,0.0004883506],"domain_scores_gemma":[0.9969493,0.0005778159,0.0005230712,0.001094824,0.0006946975,0.0001602601],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000544302,0.002254484,0.6054509,0.006224255,0.002813648,0.0003869248,0.02916524,0.006350241,0.006116466,0.1919626,0.1025166,0.04621429],"study_design_scores_gemma":[0.01466376,0.0008620499,0.3541959,0.006930117,0.0005637091,0.0001027181,0.0009650558,0.4522009,0.04849788,0.04523272,0.06856985,0.007215311],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07754052,0.001181757,0.8942165,0.002049264,0.01027933,0.004718927,0.0006368476,0.0006885871,0.008688294],"genre_scores_gemma":[0.5181157,0.00006703793,0.4700508,0.001016695,0.00172544,0.00179021,0.0008029935,0.00005405762,0.006377057],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.4458507,"threshold_uncertainty_score":0.9998337,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04170258767895742,"score_gpt":0.3110798380555782,"score_spread":0.2693772503766208,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}