{"id":"W4313680365","doi":"10.2139/ssrn.4319327","title":"Deep Reinforcement Learning for Machine Scheduling: Methodology, the State-of-The-Art, and Future Directions","year":2023,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Scheduling and Optimization Algorithms","field":"Engineering","cited_by":15,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Reinforcement learning; Computer science; Artificial intelligence; Scheduling (production processes); Machine learning; Operations research; Engineering; Operations management","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003384364,0.001306906,0.002235942,0.0005785768,0.0003169587,0.002610608,0.002745539,0.001854484,0.00460051],"category_scores_gemma":[0.008376793,0.0006149624,0.0006273459,0.001319158,0.001475763,0.003300968,0.001446867,0.004196453,0.0009519269],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001620058,"about_ca_system_score_gemma":0.00233794,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008417903,"about_ca_topic_score_gemma":0.006765668,"domain_scores_codex":[0.9992108,0.0003428842,0.00004589945,0.0001543431,0.0001520456,0.00009409409],"domain_scores_gemma":[0.9949662,0.003640365,0.0002198873,0.0003423665,0.000599231,0.0002319794],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0002131794,0.0002274319,0.002097205,0.0006924004,0.0001741615,0.00003333467,0.0001332031,0.5464204,0.0009160576,0.08237347,0.007313711,0.3594055],"study_design_scores_gemma":[0.00001175636,0.00003754385,0.0001468879,0.00006494534,0.00001044282,0.00000740582,0.0000183492,0.9594074,0.0002756653,0.03749545,0.002515004,0.000009125331],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"review","genre_scores_codex":[0.01538997,0.03015791,0.9421025,0.006003729,0.0003464251,0.00005223888,0.0001486483,0.0006504332,0.00514801],"genre_scores_gemma":[0.6825243,0.03153471,0.2716298,0.001629139,0.001789205,0.0002305645,0.0005195421,0.000349522,0.009793198],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.008417903,"threshold_uncertainty_score":0,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01588945352918465,"score_gpt":0.2622895898932567,"score_spread":0.246400136364072,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}