{"id":"W2171072930","doi":"10.1046/j.1365-2753.2001.00261.x","title":"A comparison of a Bayesian vs. a frequentist method for profiling hospital performance","year":2001,"lang":"en","type":"article","venue":"Journal of Evaluation in Clinical Practice","topic":"Healthcare Policy and Management","field":"Economics, Econometrics and Finance","cited_by":58,"is_retracted":false,"has_abstract":true,"ca_institutions":"Health Sciences Centre; Sunnybrook Health Science Centre; Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Medical Research Council; Medical Research Council Canada","keywords":"Frequentist inference; Statistics; Confidence interval; Logistic regression; Bayesian probability; Medicine; Outlier; Mortality rate; Credible interval; Statistic; Econometrics; Mathematics; Bayesian inference; Internal medicine","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.02937046,0.00008465791,0.0006936093,0.0002352588,0.00004401028,0.00002684094,0.0001467879,0.0001058311,0.0001055612],"category_scores_gemma":[0.02169734,0.00008525144,0.000254649,0.0002401774,0.00002755679,0.0006366794,0.00002407322,0.0003678217,0.00001135349],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001250174,"about_ca_system_score_gemma":0.0001297805,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001705085,"about_ca_topic_score_gemma":0.00003180423,"domain_scores_codex":[0.995989,0.0003277837,0.003168162,0.0001834332,0.0001616222,0.0001700308],"domain_scores_gemma":[0.9929531,0.002605816,0.003665322,0.000170721,0.0005268827,0.00007822458],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00294625,0.006476496,0.5617241,0.0007731679,0.002187052,0.00002098625,0.002734262,0.01202245,0.000008342245,0.2163228,0.005697335,0.1890868],"study_design_scores_gemma":[0.006535322,0.005102423,0.1012554,0.00016539,0.0009147553,0.00004657336,0.0009996262,0.5676466,0.00006220469,0.05473867,0.2621591,0.0003738445],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2297275,0.004296458,0.670442,0.07443582,0.003163083,0.002310898,0.00003438802,0.00001157205,0.01557832],"genre_scores_gemma":[0.8209094,0.0004786162,0.1776032,0.000681387,0.0002460697,0.00003321919,0.000002067025,0.000008995474,0.00003700132],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.5911819,"threshold_uncertainty_score":0.9994674,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2733207114307102,"score_gpt":0.5456729241272876,"score_spread":0.2723522126965774,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}