{"id":"W2086203781","doi":"10.1016/j.jclinepi.2007.03.010","title":"Application of generalizability theory confirmed lower reliability of the standard gamble than the feeling thermometer","year":2007,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":8,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Toronto; McMaster University","funders":"AstraZeneca","keywords":"Generalizability theory; GERD; Inter-rater reliability; Reliability (semiconductor); Medicine; COPD; Intra-rater reliability; Reflux; Physical therapy; Disease; Internal medicine; Psychology; Rating scale; Confidence interval; Developmental psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":[],"domain":null,"study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07576517,0.0012739,0.001502087,0.001731369,0.0010317,0.002076034,0.001578748,0.001909579,0.009836541],"category_scores_gemma":[0.3513426,0.0007470919,0.003599801,0.001300493,0.003178559,0.001775048,0.002321447,0.003281915,0.001966193],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008753013,"about_ca_system_score_gemma":0.001267498,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003443799,"about_ca_topic_score_gemma":0.002630859,"domain_scores_codex":[0.9473618,0.02830152,0.003374811,0.01139642,0.008495489,0.001070016],"domain_scores_gemma":[0.4620877,0.4141807,0.0130772,0.07051861,0.03894863,0.001187213],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.004147766,0.001532531,0.7169908,0.001452883,0.004609117,0.0005468127,0.01830984,0.01343283,0.0161729,0.03383308,0.01017519,0.1787963],"study_design_scores_gemma":[0.0003986123,0.004353365,0.8774995,0.0004232512,0.001807614,0.0008717136,0.002487199,0.03760211,0.01184348,0.05081561,0.01166343,0.000234042],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7629529,0.00113073,0.201024,0.001559479,0.001368168,0.002395292,0.002233877,0.0005943409,0.02674134],"genre_scores_gemma":[0.9770321,0.0001211796,0.01905921,0.0004218361,0.0001360997,0.0008167289,0.00047807,0.0002561016,0.001678752],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9242348,"threshold_uncertainty_score":0.4006893,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5161787684129466,"score_gpt":0.554718994206375,"score_spread":0.03854022579342842,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}