{"id":"W3131983709","doi":"10.1016/j.surg.2021.01.006","title":"Strengths and weaknesses in the methodology of survey-based research in surgery: A call for standardization","year":2021,"lang":"en","type":"article","venue":"Surgery","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":9,"is_retracted":false,"has_abstract":false,"ca_institutions":"University Health Network; Princess Margaret Cancer Centre; University of Toronto","funders":"","keywords":"Medicine; Descriptive statistics; Standardization; Missing data; Quality (philosophy); Transparency (behavior); Guideline; Strengths and weaknesses; Family medicine; Statistic; Statistics; Pathology; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5678135,0.0001103582,0.002491544,0.0009124117,0.0000558686,0.0001935981,0.0003297457,0.00007759732,0.0004156287],"category_scores_gemma":[0.4677614,0.00005373697,0.0005267936,0.004011179,0.00009696973,0.00008121081,0.0000474483,0.0001199608,0.000006185031],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00001845214,"about_ca_system_score_gemma":0.0005946634,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002521605,"about_ca_topic_score_gemma":0.004537879,"domain_scores_codex":[0.8781471,0.1115054,0.006009646,0.0007458507,0.003249567,0.0003423534],"domain_scores_gemma":[0.4941112,0.5016851,0.001012909,0.001290294,0.001860716,0.00003975479],"domain_codex":null,"domain_gemma":"methods","domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00004944582,0.00007442216,0.9080217,0.000168413,0.00003283311,0.00001665636,0.0003536435,0.0001375719,0.00006585424,0.0003722406,0.05475669,0.03595055],"study_design_scores_gemma":[0.0003730984,0.00003042974,0.7943005,0.0003058392,0.00006390824,0.00001016017,0.003676054,0.004296898,0.001200372,0.01704715,0.1784028,0.0002928443],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9544957,0.003215098,0.03874782,0.002284467,0.0002599168,0.0006055995,0.0001345091,0.000001556328,0.0002553827],"genre_scores_gemma":[0.9976174,0.0001388536,0.001825518,0.00009916292,0.00002034574,0.00006689433,0.00004543477,0.000006052264,0.0001802857],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3901797,"threshold_uncertainty_score":0.5367219,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9545248582571336,"score_gpt":0.6487015166490524,"score_spread":0.3058233416080812,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}