{"id":"W2207275587","doi":"10.48550/arxiv.2409.11044","title":"Computation and Complexity of Preference Inference Based on Hierarchical Models","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Constraint Satisfaction and Optimization","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Queen's University; Science Foundation Ireland; Queen's University Belfast","keywords":"Computation; Inference; Preference; Computer science; Artificial intelligence; Theoretical computer science; Mathematics; Algorithm; Statistics","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000126515,0.000183348,0.0002174033,0.0002958261,0.00006328365,0.00008846846,0.000390004,0.0001522702,0.00001472795],"category_scores_gemma":[0.000022173,0.0002049379,0.00007213963,0.0003414121,0.0002507927,0.0001586532,0.0007723933,0.0004648151,0.000008081035],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007110652,"about_ca_system_score_gemma":0.0002347775,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00005989982,"about_ca_topic_score_gemma":0.00002456537,"domain_scores_codex":[0.9987921,0.0001182438,0.0001759697,0.0006781591,0.0001044659,0.0001310258],"domain_scores_gemma":[0.9990721,0.0001691916,0.0001393121,0.0003908441,0.0001316146,0.00009689139],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000111866,0.00002366506,0.0002352103,0.00007021955,0.000009359485,0.000007706612,0.00008356699,0.6068171,0.000004094761,0.3901391,0.000008659505,0.002590096],"study_design_scores_gemma":[0.0001488777,0.00003615826,0.001588517,0.000114712,0.00001398624,6.250559e-7,0.000005675706,0.6778189,0.00002075818,0.3201262,0.000001880606,0.0001237265],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06321537,0.000009500476,0.9329408,0.0002048746,0.0001891762,0.0001910315,0.00002789932,0.0001497567,0.003071571],"genre_scores_gemma":[0.9837515,0.00002680133,0.01607791,0.00005879001,0.000009057231,5.789681e-7,0.00002017632,0.000006338583,0.00004889325],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9205361,"threshold_uncertainty_score":0.8357126,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1940580369590579,"score_gpt":0.2228332303218106,"score_spread":0.02877519336275269,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}