{"id":"W4386576789","doi":"10.18653/v1/2023.findings-eacl.125","title":"On the Role of Reviewer Expertise in Temporal Review Helpfulness Prediction","year":2023,"lang":"en","type":"article","venue":"","topic":"Sentiment Analysis and Opinion Mining","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Helpfulness; Computer science; Scarcity; Quality (philosophy); Data science; Focus (optics); Value (mathematics); Key (lock); Psychology; Machine learning; Computer security","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01060332,0.001310515,0.001115254,0.007355809,0.001077225,0.002232213,0.001162364,0.001819403,0.001085463],"category_scores_gemma":[0.04077941,0.0004169489,0.0007644866,0.003466656,0.0005719468,0.003258394,0.0008159789,0.00137056,0.001350603],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001306935,"about_ca_system_score_gemma":0.001627613,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008964346,"about_ca_topic_score_gemma":0.02314151,"domain_scores_codex":[0.9953544,0.001843599,0.0004113771,0.00134669,0.0008089669,0.0002349542],"domain_scores_gemma":[0.9384059,0.04318023,0.006933539,0.002339149,0.007650765,0.001490516],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001459858,0.0007508271,0.5143402,0.001450452,0.0005964809,0.0009515071,0.001513544,0.04683312,0.01244611,0.003314691,0.06964908,0.3466942],"study_design_scores_gemma":[0.0001371885,0.0003834983,0.09444772,0.0002157777,0.0002687246,0.001629925,0.0004040015,0.8675842,0.007869797,0.006380904,0.02053604,0.0001422627],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8197378,0.02574732,0.122771,0.004417643,0.001144214,0.0004915068,0.01231292,0.003060572,0.01031711],"genre_scores_gemma":[0.9408431,0.001937341,0.04220997,0.0004036862,0.001099971,0.0001553694,0.01005998,0.0001430595,0.00314746],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9893967,"threshold_uncertainty_score":0.05607641,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02892292897469124,"score_gpt":0.2763956564183979,"score_spread":0.2474727274437066,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}