{"id":"W2754127623","doi":"10.1007/s11081-017-9366-1","title":"Best practices for comparing optimization algorithms","year":2017,"lang":"en","type":"article","venue":"Optimization and Engineering","topic":"Stochastic Gradient Optimization Techniques","field":"Computer Science","cited_by":189,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of British Columbia, Okanagan Campus; University of British Columbia","funders":"","keywords":"Benchmarking; Best practice; Process (computing); Task (project management); Financial engineering; Optimization algorithm","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06312083,0.004196924,0.005249151,0.01697858,0.003126682,0.01178327,0.008567775,0.006649917,0.0122159],"category_scores_gemma":[0.3444492,0.002109722,0.004791741,0.02027007,0.003392062,0.007511736,0.005472621,0.00835472,0.004378736],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003039992,"about_ca_system_score_gemma":0.00441021,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004962219,"about_ca_topic_score_gemma":0.005654003,"domain_scores_codex":[0.847999,0.08755508,0.02106064,0.006958569,0.03481982,0.001606855],"domain_scores_gemma":[0.7459372,0.1625101,0.006432149,0.05234816,0.03153537,0.001237137],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001670362,0.0009985302,0.00490206,0.01179483,0.005309477,0.0003583316,0.001048048,0.04926183,0.003988111,0.1449164,0.06180615,0.7139459],"study_design_scores_gemma":[0.00201031,0.001935465,0.007045638,0.01437925,0.00476137,0.001633548,0.002043014,0.1788602,0.03690433,0.5378146,0.2117373,0.0008750099],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008789917,0.02655277,0.9354294,0.002487913,0.00243838,0.001181572,0.003203549,0.004878529,0.015038],"genre_scores_gemma":[0.04490902,0.004777846,0.9416788,0.0005962531,0.0003395788,0.002161136,0.002479673,0.001718011,0.001339788],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.9368792,"threshold_uncertainty_score":0.3338189,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05613976093467386,"score_gpt":0.2990190674639251,"score_spread":0.2428793065292512,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}