{"id":"W4411267377","doi":"10.2139/ssrn.5288532","title":"Designing AI-Human Supervision to Improve Worker Performance: A Field Experiment in Service Operations","year":2025,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Digital Transformation in Industry","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University","funders":"","keywords":"Field (mathematics); Service (business); Human services; Operations management; Computer science; Business; Engineering management; Process management; Knowledge management; Engineering; Marketing; Political science; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.0006646831,0.0003367694,0.0002984139,0.0004414855,0.000160648,0.0003131785,0.0005274022,0.0003805975,0.00006262154],"category_scores_gemma":[0.00001524902,0.0003578201,0.00009665556,0.0003530013,0.00000675547,0.0004763581,0.0001632736,0.005386278,0.00003267199],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001944764,"about_ca_system_score_gemma":0.001200411,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00008600795,"about_ca_topic_score_gemma":0.0006756188,"domain_scores_codex":[0.9972897,0.00003656396,0.0006593004,0.000256291,0.0002819558,0.001476189],"domain_scores_gemma":[0.999393,0.00003006537,0.00003286191,0.0003123701,0.0001213505,0.0001103205],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003390561,0.00007226154,0.000332123,0.0002755692,0.0001984868,0.000003063528,0.002770581,0.9553311,0.003308399,0.00413408,0.0004724773,0.03306796],"study_design_scores_gemma":[0.01091996,0.003168865,0.001310369,0.02258128,0.000476739,0.0005328471,0.04571425,0.5560187,0.2825717,0.05163343,0.01562309,0.009448787],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8152184,0.001720387,0.154856,0.002022313,0.002003005,0.001213245,0.00002113064,0.0003243424,0.02262114],"genre_scores_gemma":[0.996953,0.0007015607,0.0006008927,0.0004092863,0.0002335192,0.0001776641,0.00002620944,0.00004106232,0.0008568369],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3993124,"threshold_uncertainty_score":0.9998874,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01229313164457681,"score_gpt":0.2669384212149841,"score_spread":0.2546452895704073,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}