{"id":"W7124297895","doi":"10.65109/fkek1875","title":"Soft Condorcet Optimization for Ranking of General Agents","year":2025,"lang":"","type":"article","venue":"","topic":"Game Theory and Voting Systems","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal; University of Waterloo; Google (Canada)","funders":"","keywords":"Condorcet method; Ranking (information retrieval); Voting; Rank (graph theory); Preference; Social choice theory; Variety (cybernetics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001444481,0.0002000696,0.0007292483,0.0003759272,0.0001601869,0.00008166745,0.0002816684,0.0002035246,0.001390879],"category_scores_gemma":[0.0002889442,0.0002532753,0.0002677057,0.0003426986,0.00007467769,0.0001572651,0.00006774072,0.00008416357,0.00003126403],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006805731,"about_ca_system_score_gemma":0.00004447401,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00009520637,"about_ca_topic_score_gemma":0.000004082211,"domain_scores_codex":[0.9977716,0.00004263156,0.001381475,0.0004462034,0.00002776225,0.000330364],"domain_scores_gemma":[0.9985725,0.0002097719,0.0007215741,0.0003489382,0.0001022714,0.00004497803],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000105155,0.0001085647,0.0113855,0.0006419357,0.0002533166,1.970069e-7,0.0002864584,0.1367145,0.00003282053,0.8476251,0.001594767,0.001251704],"study_design_scores_gemma":[0.002829253,0.0001144069,0.0007065301,0.0002025837,0.00005181748,6.704963e-7,0.0001444351,0.9557264,0.00107935,0.02388453,0.01494376,0.0003162776],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07407989,0.001425188,0.8473003,0.0002707212,0.002958258,0.000924346,0.0002174206,0.00002833197,0.07279555],"genre_scores_gemma":[0.9447121,0.00009273785,0.006367225,0.0003022455,0.000153379,0.00003501888,0.00003747236,0.00002247022,0.04827737],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8706322,"threshold_uncertainty_score":0.999992,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03634292329246118,"score_gpt":0.2602797094126154,"score_spread":0.2239367861201542,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}