{"id":"W2319227677","doi":"10.1097/nci.0b013e31822db44e","title":"When and How to Evaluate Interrater Reliability of Patient Assessment Tools","year":2011,"lang":"en","type":"article","venue":"AACN Advanced Critical Care","topic":"Intensive Care Unit Cognitive Disorders","field":"Medicine","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Icon; Inter-rater reliability; Citation; Download; Medicine; Grey literature; Library science; MEDLINE; Computer science; Psychology; World Wide Web","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.00009373442,0.0001741039,0.0003380193,0.00007659429,0.00003583939,0.00001238409,0.0000614391,0.00006794962,0.000297695],"category_scores_gemma":[0.01409798,0.0001468765,0.00008836298,0.00007525542,0.0002596451,0.0001559436,0.0001181891,0.0002044138,0.000008797335],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001178229,"about_ca_system_score_gemma":0.00006548887,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001041905,"about_ca_topic_score_gemma":0.00000928838,"domain_scores_codex":[0.9987309,0.00009475694,0.0002125899,0.0003819536,0.0002980115,0.0002818171],"domain_scores_gemma":[0.987311,0.0002149511,0.0000294684,0.0003211321,0.01189626,0.0002272095],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.0081572,0.001774791,0.09721563,0.006571253,0.00038574,0.0007608236,0.1065123,0.00001027977,0.1408889,0.02315338,0.01253607,0.6020337],"study_design_scores_gemma":[0.006423739,0.02027589,0.1735367,0.002325037,0.001011043,0.00009397785,0.4562966,0.00009777476,0.3141283,0.01446541,0.009883791,0.001461678],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.972221,0.0002075565,0.002605255,0.006497778,0.0003036676,0.0009119199,0.00008889451,0.00004377534,0.01712022],"genre_scores_gemma":[0.9725037,0.000003957957,0.01579678,0.01149519,0.00001624854,0.00007699577,0.00002728537,0.00002316521,0.00005664685],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.600572,"threshold_uncertainty_score":0.9942067,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03938211208478479,"score_gpt":0.3527617728504692,"score_spread":0.3133796607656844,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}